{"as_of":"2026-08-11T08:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee3d9f40cba9c264722ba19bf6f2470f6d6b4a6b08e33db1b671778c25276f61","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:14:46.381014Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:05:48.315868Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-10T16:14:46.381014Z","title":"I-llm: Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13484","last_updated":"2025-03-11T06:49:47Z","snapshot_observed_at":"2026-08-10T15:51:43.152851Z","submitted_at":"2025-01-23T08:57:33Z","title":"MambaQuant: Quantizing the Mamba Family with Variance Aligned Rotation Methods","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T16:14:46.381014Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2501.13484"},"observation_digest":"sha256:68fb2308424381a6f6119be4acd74cc85d349aa76283b79d62f6f68a1699afa4","observation_id":"1f6d2e40-1ea0-4071-927c-229c79d75d7d","resolution":{"observed_at":"2026-08-10T16:14:46.381014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-10T16:13:19.929890Z","title":"I-llm: Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13987","last_updated":"2025-01-23T08:24:25Z","snapshot_observed_at":"2026-08-10T15:53:21.557278Z","submitted_at":"2025-01-23T08:24:25Z","title":"OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T16:13:19.929890Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2501.13987"},"observation_digest":"sha256:5e80bdfbb9fba31a1462611363f11f192195a1c631b9dcbe56796da661fcbb7d","observation_id":"aaaa6f37-4691-448f-b13b-563a8c370dec","resolution":{"observed_at":"2026-08-10T16:13:19.929890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-09T19:12:56.076730Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00425","last_updated":"2025-08-10T04:13:03Z","snapshot_observed_at":"2026-08-11T03:00:26.939226Z","submitted_at":"2025-02-01T13:08:02Z","title":"MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T19:12:56.076730Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2502.00425"},"observation_digest":"sha256:37e93a842264ac845024e55262da1f70e2512e20a7d13ceedac1f09162498491","observation_id":"34c4d1a8-c958-497c-b69a-e086544699da","resolution":{"observed_at":"2026-08-09T19:12:56.076730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-05T11:39:16.858554Z","title":"I- llm: Efficient integer-only inference for fully-quantized low-bit large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02411","last_updated":"2025-09-02T15:19:57Z","snapshot_observed_at":"2026-08-06T21:38:56.067118Z","submitted_at":"2025-09-02T15:19:57Z","title":"A Survey: Towards Privacy and Security in Mobile Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T11:39:16.858554Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2509.02411"},"observation_digest":"sha256:f7c6d0a3ac167be3ebe7431373227612b53f3064af77d5bf39fb5877e0f03e7a","observation_id":"bc52a88e-cc7f-4a45-86de-6f6024becd8b","resolution":{"observed_at":"2026-08-05T11:39:16.858554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-03T20:02:51.187405Z","title":"I-llm: Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.21513","last_updated":"2026-05-29T08:25:08Z","snapshot_observed_at":"2026-08-10T14:06:04.128224Z","submitted_at":"2025-11-26T15:46:22Z","title":"IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T20:02:51.187405Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2511.21513"},"observation_digest":"sha256:ea825d8a26f0d8f1cf129044b7d213745ea5356f8236bb42e97d4fb3e158aa40","observation_id":"490beeb3-ca10-49cc-9299-4a0cf099750c","resolution":{"observed_at":"2026-08-03T20:02:51.187405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2604.04523","last_updated":"2026-04-06T08:35:41Z","snapshot_observed_at":"2026-08-11T02:10:34.032613Z","submitted_at":"2026-04-06T08:35:41Z","title":"LOCALUT: Harnessing Capacity-Computation Tradeoffs for LUT-Based Inference in DRAM-PIM","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T20:05:11.335715Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2604.04523"},"observation_digest":"sha256:2b0059b726bda51107183bab712ef264bca5ae9d45e275e63294d4d527024934","observation_id":"c4cad0ed-f424-4df6-8c0a-7caca0d107ac","resolution":{"observed_at":"2026-05-10T22:15:49.600419Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2604.19167","last_updated":"2026-04-21T07:25:02Z","snapshot_observed_at":"2026-07-06T23:05:53.378585Z","submitted_at":"2026-04-21T07:25:02Z","title":"LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T03:04:14.900791Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2604.19167"},"observation_digest":"sha256:a06adf2b1831d506a7a5550d6df487b8859d8c9cd8ea5e3a03bc54c3799df182","observation_id":"1689b1ce-b702-4cf5-b4d8-7aea8d58bc54","resolution":{"observed_at":"2026-05-11T12:46:04.909793Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2604.25306","last_updated":"2026-04-28T07:13:26Z","snapshot_observed_at":"2026-07-31T14:57:16.193712Z","submitted_at":"2026-04-28T07:13:26Z","title":"QFlash: Bridging Quantization and Memory Efficiency in Vision Transformer Attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-07T16:57:13.714858Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2604.25306"},"observation_digest":"sha256:222851fa3b15b62984feff2e845786800328a439619f41ea0a0c32845855d5b3","observation_id":"d81ce732-3e0b-4860-864a-40cb03eb4197","resolution":{"observed_at":"2026-05-11T23:31:13.467905Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2605.18800","last_updated":"2026-05-11T10:51:40Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-11T10:51:40Z","title":"Theory-optimal Quantization Based on Flatness","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T22:38:06.888665Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2605.18800"},"observation_digest":"sha256:32687694f88e3770d570a767762be17e3e9e4dacc9f57da439de267216136ce3","observation_id":"da198aef-495c-470c-be50-04cd1b648111","resolution":{"observed_at":"2026-05-20T22:39:09.877448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-02T05:44:37.705586Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:9303392b1da2f99a114e8dcc9a9f6de52c63c5b05c1bb14767be7085b91ea93e","observation_id":"bd04d0b6-7d5c-4822-a995-1676b3fb7806","resolution":{"observed_at":"2026-05-20T05:23:03.664882Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2605.24019","last_updated":"2026-05-20T06:11:25Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-20T06:11:25Z","title":"MGVQ: Synergizing Multi-dimensional Sensitivity-Aware and Gradient-Hessian Fusion for Vector Quantization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T17:36:45.807397Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2605.24019"},"observation_digest":"sha256:dd0d7ab17edc5a7d0c9625c8c6499082f60ab513f8e03d3a2f27995121816af1","observation_id":"e64e12ef-edd7-40b8-ba62-dc909f7881e7","resolution":{"observed_at":"2026-07-01T15:05:48.318099Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.17849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-01T15:05:48.315868Z","title":"Yoon Kim and Alexander M Rush","venue":null,"work_id":"03c1d553-c717-4773-8953-828cda57d33f","year":2024},"citing_paper":{"arxiv_id":"2605.24144","last_updated":"2026-05-22T19:06:22Z","snapshot_observed_at":"2026-07-06T23:34:13.859813Z","submitted_at":"2026-05-22T19:06:22Z","title":"EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T14:35:02.484377Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2605.24144"},"observation_digest":"sha256:5e4719ee0ebabe7ddde296961944f92e40e5f661799cd4069867e706b2c8784c","observation_id":"4ceafbf5-d55c-4ad1-958f-e7e342ded546","resolution":{"observed_at":"2026-06-30T14:44:45.577156Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-12T05:11:18.690792Z","title":"arXiv preprint arXiv:2405.17849 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03057","last_updated":"2026-07-03T07:46:13Z","snapshot_observed_at":"2026-08-07T17:41:49.626831Z","submitted_at":"2026-07-03T07:46:13Z","title":"LACE-SVD: Loss-Aware SVD with Cumulative Error Correction for LLM Compression","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-12T05:11:18.690792Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2607.03057"},"observation_digest":"sha256:b862b679b49fb1375de87ac6ebf6956ac4fa1f72991a190f661edcdc4520ab35","observation_id":"e0c1e0da-c194-42ca-8880-07fa92883e7e","resolution":{"observed_at":"2026-07-12T05:11:18.690792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-08-02T14:29:28.763839Z","title":"arXiv preprint arXiv:2405.17849 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20434","last_updated":"2026-05-11T10:50:26Z","snapshot_observed_at":"2026-08-06T17:07:51.320317Z","submitted_at":"2026-05-11T10:50:26Z","title":"Break Through the Compression Bottleneck: From Theory to Practice","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T14:29:28.763839Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2607.20434"},"observation_digest":"sha256:d83a6c905b701c2c627e9d2d1850a32ab844ca6e028bbc3622dc7a44fd76a387","observation_id":"c72051f7-88bf-4e14-9a50-49e59225e258","resolution":{"observed_at":"2026-08-02T14:29:28.763839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17849","snapshot_observed_at":"2026-07-30T23:38:38.615687Z","title":"I-LLM : Efficient integer-only inference for fully-quantized low-bit large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23390","last_updated":"2026-07-25T23:29:23Z","snapshot_observed_at":"2026-08-06T08:16:43.110012Z","submitted_at":"2026-07-25T23:29:23Z","title":"When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation","version":1},"reference_index":146,"source":"arxiv_source","source_observed_at":"2026-07-30T23:38:38.615687Z"},"links":{"cited_paper":"/paper/2405.17849","citing_paper":"/paper/2607.23390"},"observation_digest":"sha256:00cf87b48a35762caedaff7b07942125be2bd31fa189813bf15d7815aa764d70","observation_id":"29e8d529-e7f6-4b9e-af2f-bc81687236eb","resolution":{"observed_at":"2026-07-30T23:38:38.615687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.17849/citation-record","integrity":"/paper/2405.17849/integrity","json":"/paper/2405.17849/citation-record.json","paper":"/paper/2405.17849"},"outbound":[],"paper":{"arxiv_id":"2405.17849","last_updated":"2024-06-05T15:26:58Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T11:06:55.687315Z","submitted_at":"2024-05-28T05:56:11Z","title":"I-LLM: Efficient Integer-Only Inference for Fully-Quantized Low-Bit Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2405.17849."}