{"as_of":"2026-08-19T18:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5b2442b1195e37e68a79c9666ac1c376f8d851ddbe86e752784a77a7a0bad2d","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:32:56.683588Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01967/citation-record","integrity":"/paper/2506.01967/integrity","json":"/paper/2506.01967/citation-record.json","paper":"/paper/2506.01967"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.869855Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":null,"work_id":"34f411b5-aaa7-4672-a8a0-8bd496dcd3ed","year":2023},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.618143Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:a99cdc177054226bd7f744a58a0ee6a289a2e79e22ed067eeeba5378de203752","observation_id":"2e7f32f6-cba5-46b3-a522-01e5b6694538","resolution":{"observed_at":"2026-08-15T22:32:56.872450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T22:32:56.622292Z","title":"The Llama 3 Herd of Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.622292Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:2760b476329ae5e1074e733f2296aae4ab0805e860c9f85d0738a71bc3e0d210","observation_id":"2dfc4879-bdfd-4b6b-b2bc-ec0aeefb4171","resolution":{"observed_at":"2026-08-15T22:32:56.622292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.862855Z","title":"Training Experimental Language Models with Low Resources, for the Hungar- ian Language,","venue":null,"work_id":"51d2343f-648e-4643-8185-275ad801f414","year":2023},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.625680Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:5494fe179381a7ab680983593ca5b18cb41a303466b8ef06aa424b525e8d7d3b","observation_id":"2d5dcd38-aa94-4e19-ae58-c8821668310e","resolution":{"observed_at":"2026-08-15T22:32:56.865457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.855519Z","title":"Fake News Detection System, based on CBOW and BERT,","venue":null,"work_id":"6bdd66f6-8db2-40eb-9415-fc85d7265d2f","year":2025},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.629085Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:ad4038b90c8322d60e4c87d9810848d8b02472f8646d20aa50060959e64afeaf","observation_id":"0d46a468-34c4-420c-b632-23ee613e2b85","resolution":{"observed_at":"2026-08-15T22:32:56.858045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.849150Z","title":"Model Compression and Efficient Inference for Large Language Models: A Survey","venue":null,"work_id":"4e988c4a-9b4b-4805-8140-45e402260bfd","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.632018Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:ab3d5aa4698a9dc16814ce428aac38e8caf28eb7f7ed06a52a398a23d11ca26e","observation_id":"f3e51deb-05d2-4466-9ac0-f62ddba91bcc","resolution":{"observed_at":"2026-08-15T22:32:56.851529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-16T15:08:25.859326Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-15T22:32:56.634579Z","title":"A Survey on Model Compression for Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.634579Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:7560c7455f5d92db0608538f3328b9de42e8c92d6b910079b4c6607a21dc3d12","observation_id":"f897c398-904e-43bf-9df3-7e7471abb794","resolution":{"observed_at":"2026-08-15T22:32:56.634579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05877","last_updated":"2017-12-15T23:56:52Z","snapshot_observed_at":"2026-08-14T20:03:06.929797Z","submitted_at":"2017-12-15T23:56:52Z","title":"Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05877","snapshot_observed_at":"2026-08-15T22:32:56.637871Z","title":"Quantization and Training of Neural Networks for Efficient Integer- Arithmetic-Only Inference","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.637871Z"},"links":{"cited_paper":"/paper/1712.05877","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:0c517a9f297f981afcac8aabf37388702f8531c01c1d9fc56d2745f7ef09f833","observation_id":"c4169687-6dbf-412c-8aed-f12b99428c6f","resolution":{"observed_at":"2026-08-15T22:32:56.637871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.842282Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transform- ers at Scale,","venue":null,"work_id":"6aa9e525-71c2-4338-853c-b2642eb2a9a6","year":2022},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.640681Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:62978f2d778eb5512d9debb6e337e51f41d3bb8bcac7dee62d91368a9384c129","observation_id":"134ce228-6141-448e-a9ff-d3842051a427","resolution":{"observed_at":"2026-08-15T22:32:56.844819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.835166Z","title":"SmoothQuant: Accurate and Efficient Post- Training Quantization for Large Language Models,","venue":null,"work_id":"098f96e2-f692-4ad9-87b6-abd82591ea98","year":2023},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.643032Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:4cbff86ee8f79f2d060fe10b8cfbe4dec665421cc4edc60461069d16c3f6834e","observation_id":"de06a502-15b9-491e-a3d8-bf5a8446c865","resolution":{"observed_at":"2026-08-15T22:32:56.837793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14428","last_updated":"2024-05-23T10:54:14Z","snapshot_observed_at":"2026-08-17T01:31:28.830514Z","submitted_at":"2024-05-23T10:54:14Z","title":"Mitigating Quantization Errors Due to Activation Spikes in GLU-Based LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14428","snapshot_observed_at":"2026-08-15T22:32:56.645611Z","title":"Mitigating Quantization Errors Due to Activation Spikes in GLU-Based LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.645611Z"},"links":{"cited_paper":"/paper/2405.14428","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:c61010f31d713e0c1d95ad48c49e6ffb5eef3c2c92d77dc3b76c4fd6ce955acd","observation_id":"469d6fd3-51ab-4d6c-8996-a7e54a8b852c","resolution":{"observed_at":"2026-08-15T22:32:56.645611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.648270Z","title":"DuQuant: Distribut- ing Outliers via Dual Transformation Makes Stronger Quantized LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.648270Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:e902bb5d4b57f921cbe365f0079ad33b2458b36c3fa383228088c8417c04e066","observation_id":"8c1cf7b6-4f00-4ac4-afa5-7b54966239f2","resolution":{"observed_at":"2026-08-15T22:32:56.648270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19102","last_updated":"2024-04-16T06:08:05Z","snapshot_observed_at":"2026-08-16T14:47:51.296619Z","submitted_at":"2023-10-29T18:33:05Z","title":"Atom: Low-bit Quantization for Efficient and Accurate LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19102","snapshot_observed_at":"2026-08-15T22:32:56.650567Z","title":"Atom: Low-bit Quantization for Efficient and Accurate LLM Serving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.650567Z"},"links":{"cited_paper":"/paper/2310.19102","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:02fff52a8b1dfdf4557c422b45ba8e200d210cdc166a724791b99cb04f1838ef","observation_id":"2ed7aee6-40e6-4c0c-9e9a-517ce38ae763","resolution":{"observed_at":"2026-08-15T22:32:56.650567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.824022Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","venue":null,"work_id":"abcd699c-8452-474f-86c6-1cac4d557dcf","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.653179Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:43ca6cd80a62c1eb5712a1dcdc173f0135a6986859a5c42c9cf34564b33385ed","observation_id":"3036aa96-bb40-4787-9a86-9a85be911efa","resolution":{"observed_at":"2026-08-15T22:32:56.826893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.815829Z","title":"OmniQuant: Omnidirectionally calibrated quantization for large lan- guage models,","venue":null,"work_id":"aa19dfaa-b9b0-4fe4-95d5-6a9fca139e6b","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.655481Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:c3ea049e9b71ce16dd6f69965bc2a5e9497e45ab6525f70a6683b66a05440883","observation_id":"8a7c6e0f-3921-49d0-b55b-474037d4c74c","resolution":{"observed_at":"2026-08-15T22:32:56.819470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.657770Z","title":"SpinQuant: LLM quantization with learned rotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.657770Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:1c477faa9ba59fbbf9ddd48e5fd6e4efea89c0b8c4b5a46bb74a4847ebef9c39","observation_id":"6a3c0d32-eeb1-4de1-8ce9-5b30cc149329","resolution":{"observed_at":"2026-08-15T22:32:56.657770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.802787Z","title":"SPQR: A sparse-quantized representation for near- lossless llm weight compression,","venue":null,"work_id":"c56e0733-3b5b-463f-a5bf-f9296f206619","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.660041Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:134225030d4f058c7a4c26ba76ed164f7f9cdd060bb7d16c95ad72fa7e6c466b","observation_id":"cc3e73fc-550b-4da5-9c7d-721f549644f3","resolution":{"observed_at":"2026-08-15T22:32:56.805961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.794591Z","title":"SqueezeLLM: Dense-and-Sparse Quantization,","venue":null,"work_id":"68dde7c1-9a1a-465f-b445-a9ce4e27c386","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.662274Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:795f34731ef46d09cf8d48abab7c0ea4551466396386852555afc230be6cb3e2","observation_id":"9ce304ed-0106-4240-bee4-bf6407268ae8","resolution":{"observed_at":"2026-08-15T22:32:56.797424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.785202Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks,","venue":null,"work_id":"3d825476-0268-4522-bd69-04f59e572e13","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.664995Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:27fd12a2e7535aff6aa66e93d5cfb1278219ec03fe3b784de213caef9c674e9b","observation_id":"0733c33f-5d09-4d69-a979-7063aeeb175b","resolution":{"observed_at":"2026-08-15T22:32:56.789520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.776379Z","title":"EfficientQAT: Effi- cient Quantization-Aware Training for Large Language Models","venue":null,"work_id":"49335ad5-1cf0-4514-8ff0-cf936cb6c025","year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.668162Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:61b8188794bb119275c9acbf9c57d0fb51dd80055375867eb6e35714977d68bf","observation_id":"5f1e67f2-7ece-485f-a683-d2bb0bb6489c","resolution":{"observed_at":"2026-08-15T22:32:56.779057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.768555Z","title":"OPTQ: Accurate quantization for generative pre- trained transformers,","venue":null,"work_id":"0fc2395f-e58b-49e6-8c80-a85b7ab65617","year":2023},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.671278Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:600c897ee63f717bd2f4afc8ab7cd0756c34953d86e737410f0241a478280238","observation_id":"e2bee141-592a-412a-bb37-e0a4ad81a499","resolution":{"observed_at":"2026-08-15T22:32:56.771360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09426","last_updated":"2025-08-10T14:08:54Z","snapshot_observed_at":"2026-08-16T13:10:06.311790Z","submitted_at":"2024-10-12T08:10:28Z","title":"FlatQuant: Flatness Matters for LLM Quantization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09426","snapshot_observed_at":"2026-08-15T22:32:56.673897Z","title":"FlatQuant: Flatness Matters for LLM Quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.673897Z"},"links":{"cited_paper":"/paper/2410.09426","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:c9a572f3def05f4b1af6dd3bc4533295c3f39c8e867ff4de9e3c4a409d0671ec","observation_id":"f05e635b-5436-40eb-9de6-dfb5d3d91b5f","resolution":{"observed_at":"2026-08-15T22:32:56.673897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.676563Z","title":"Pointer Sentinel Mixture Models,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.676563Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:8b85ba33fe6317f7dae6a0a65e3fb550a6ab3c6771a9ba6c8a86b1a1d2b09d0c","observation_id":"0b17f85a-438f-4411-9ec3-2ea19a8556bf","resolution":{"observed_at":"2026-08-15T22:32:56.676563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.678807Z","title":"Transformers: State- of-the-Art Natural Language Processing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.678807Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:97a61dd2d84a54a932fe58220e5f8f7ad9a2cf0f5fea05c815afba1daafe362e","observation_id":"2d9f69ee-2caf-4ec3-b936-f28811000039","resolution":{"observed_at":"2026-08-15T22:32:56.678807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:32:56.755955Z","title":"PyTorch: An im- perative style, high-performance deep learning library,","venue":null,"work_id":"9c43dbd7-e446-4be6-8b09-638e0259d3d2","year":2019},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.681065Z"},"links":{"citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:f312e46f2e7d9021de19e1d0facce912e7a11b11b359102a90e493d90b650ac7","observation_id":"93e53699-12ce-4c31-a23e-d7e0ff34bb55","resolution":{"observed_at":"2026-08-15T22:32:56.759750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T22:32:56.683588Z","title":"Mistral 7B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:32:56.683588Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.01967"},"observation_digest":"sha256:a84c17d55281d96b4d03ec7f4f1260829d5a29612af884529e9aa3405db59972","observation_id":"9aa20d24-86c4-4662-9ab6-b91fb800906c","resolution":{"observed_at":"2026-08-15T22:32:56.683588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01967","last_updated":"2025-05-11T17:13:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T06:38:39.737367Z","submitted_at":"2025-05-11T17:13:55Z","title":"Turning LLM Activations Quantization-Friendly"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2506.01967."}