{"as_of":"2026-08-11T11:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8809628f8e2373cf0ec7439fa0d85adda9d7b817eca5bf5ebdf5575597b46d7","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T20:11:43.559035Z","state":"measured"},{"denominator":96,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":96,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":81,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:39:36.651851Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":4,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-11T04:39:36.651851Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-08-11T04:33:55.415799Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:39:36.651851Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2412.18653"},"observation_digest":"sha256:f162b6f7a9e0f8f5225b819525b206b1ed5b70d7355d35f5c1a6fcd9cd86fdd9","observation_id":"1c3c529f-d120-49a8-82bc-a475ec652e09","resolution":{"observed_at":"2026-08-11T04:39:36.651851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-11T00:46:17.793499Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.793499Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:6e39a66edaf0b8fa4f63444c36865c8a4f0869f7de9a7539b0e0eb0c330e6386","observation_id":"04dc7294-ab78-4fd3-9355-d82b13b6312d","resolution":{"observed_at":"2026-08-11T00:46:17.793499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-10T19:08:07.937338Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10658","last_updated":"2025-01-18T05:27:25Z","snapshot_observed_at":"2026-08-11T05:35:14.813751Z","submitted_at":"2025-01-18T05:27:25Z","title":"LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T19:08:07.937338Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2501.10658"},"observation_digest":"sha256:245600a2ec8591e6ceeede6a4283775cf63e36bed6c16dcab2005be0a5361c68","observation_id":"9132cc3c-5d72-4be5-9d55-e4a14c08dcfd","resolution":{"observed_at":"2026-08-10T19:08:07.937338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-10T21:37:14.342665Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.13111","last_updated":"2025-01-08T14:38:13Z","snapshot_observed_at":"2026-08-10T21:27:53.710306Z","submitted_at":"2025-01-08T14:38:13Z","title":"iServe: An Intent-based Serving System for LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-10T21:37:14.342665Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2501.13111"},"observation_digest":"sha256:1acd812aa961cdbd6d24d09c8dcab43cf3136b542fb14d8cd810c0ba1e5d4e8c","observation_id":"6b50f20f-bbe8-4aef-b7bf-46858c41276f","resolution":{"observed_at":"2026-08-10T21:37:14.342665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-09T16:44:01.282391Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01083","last_updated":"2025-08-06T03:09:38Z","snapshot_observed_at":"2026-08-10T06:48:33.214754Z","submitted_at":"2025-02-03T05:50:55Z","title":"Tool Unlearning for Tool-Augmented LLMs","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T16:44:01.282391Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.01083"},"observation_digest":"sha256:8f49ce4ed64f3f045d6374cde7f9566ade162aee95b67757f9f2ee5182fc78be","observation_id":"a09b6e50-0616-4d55-8c6d-c82b853a45a5","resolution":{"observed_at":"2026-08-09T16:44:01.282391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-09T16:30:40.483475Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01146","last_updated":"2025-02-03T08:33:44Z","snapshot_observed_at":"2026-08-09T19:58:49.331330Z","submitted_at":"2025-02-03T08:33:44Z","title":"Quantum Machine Learning: A Hands-on Tutorial for Machine Learning Practitioners and Researchers","version":1},"reference_index":298,"source":"arxiv_source","source_observed_at":"2026-08-09T16:30:40.483475Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.01146"},"observation_digest":"sha256:6d064643ae357c4fe348f79d68dc45f9d1f00f0c12ac2af41ab5d995581d54d5","observation_id":"d768a23c-ee22-4ea7-96f3-1d4167d6fee5","resolution":{"observed_at":"2026-08-09T16:30:40.483475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T20:44:48.451632Z","title":"Malinovskii, V ., Panferov, A., Ilin, I., Guo, H., Richt´arik, P., and Alistarh, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05003","last_updated":"2025-06-10T18:01:40Z","snapshot_observed_at":"2026-08-09T18:46:49.510936Z","submitted_at":"2025-02-07T15:23:34Z","title":"QuEST: Stable Training of LLMs with 1-Bit Weights and Activations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T20:44:48.451632Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.05003"},"observation_digest":"sha256:a7622b0eaf63044a986ee44ae75e6ff1259bddf5667b24f72a699919c2fa1102","observation_id":"a59fb065-89e2-437c-af6e-5e24e6dc7a94","resolution":{"observed_at":"2026-08-08T20:44:48.451632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T15:08:46.199820Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06567","last_updated":"2026-05-26T13:17:29Z","snapshot_observed_at":"2026-08-09T16:12:40.050000Z","submitted_at":"2025-02-10T15:34:42Z","title":"Membership Inference Risks in Quantized Models: A Theoretical and Empirical Study","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T15:08:46.199820Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.06567"},"observation_digest":"sha256:c098c42709da67f83faf50bba71a5a20f4f54dc9b2502b4a376dde6276d49d0a","observation_id":"d2261239-fbc5-4be4-bb27-14fe8c678270","resolution":{"observed_at":"2026-08-08T15:08:46.199820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T11:39:09.518281Z","title":"Ma, S., Wang, H., Ma, L., Wang, L., Wang, W., Huang, S., Dong, L., Wang, R., Xue, J., and Wei, F","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07780","last_updated":"2026-07-15T12:46:32Z","snapshot_observed_at":"2026-08-11T11:21:32.219873Z","submitted_at":"2025-02-11T18:59:35Z","title":"DarwinLM: Evolutionary Structured Pruning of Large Language Models","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T11:39:09.518281Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.07780"},"observation_digest":"sha256:3857ed52d839d4a548e766724ad50c83e299527ecd789e84037e72ca802652fa","observation_id":"2b9858a8-0484-4a0d-9041-bcaa8dd21d10","resolution":{"observed_at":"2026-08-08T11:39:09.518281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T23:43:16.740170Z","title":"The era of 1-bit LLMs: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08795","last_updated":"2025-02-12T21:19:28Z","snapshot_observed_at":"2026-08-11T05:15:06.700228Z","submitted_at":"2025-02-12T21:19:28Z","title":"Low-Resolution Neural Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T23:43:16.740170Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2502.08795"},"observation_digest":"sha256:2a0e7d989d8a9ad8bfb96c5134cb1dd1ad91086eda06a3e2c7d0d8c648b4d35f","observation_id":"779fd41e-4701-4cc1-aa53-ab21a07dc204","resolution":{"observed_at":"2026-08-07T23:43:16.740170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":172,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:76f2b0d4b54a9b51d9ca3edfb2177e73af0796d6a723b70060b6a3326d207780","observation_id":"44b64a10-e955-461f-9b51-5e8de27128da","resolution":{"observed_at":"2026-05-23T01:05:16.308383Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T10:59:50.599189Z","title":"The Era of 1-bit LLMs : All Large Language Models are in 1.58 Bits , February 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2503.18002","last_updated":"2025-03-25T12:05:26Z","snapshot_observed_at":"2026-08-09T03:28:52.903250Z","submitted_at":"2025-02-12T02:40:44Z","title":"Neuromorphic Principles for Efficient Large Language Models on Intel Loihi 2","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T10:59:50.599189Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2503.18002"},"observation_digest":"sha256:8af4b014a984e81811ed5f3fae0439e30da339edce7a8ce3936c017f38b10de2","observation_id":"124fdf37-b321-4136-8a77-7f46bb17a56f","resolution":{"observed_at":"2026-08-08T10:59:50.599189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T15:41:07.779945Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14302","last_updated":"2025-05-20T12:54:43Z","snapshot_observed_at":"2026-08-07T15:43:23.244437Z","submitted_at":"2025-05-20T12:54:43Z","title":"Scaling Law for Quantization-Aware Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:41:07.779945Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2505.14302"},"observation_digest":"sha256:7e962783d8fe89007128ea52b83d4e1899b074e19199168aa153052b2ce98a9a","observation_id":"6af10574-3c48-4c09-ba65-7a7e18cf931d","resolution":{"observed_at":"2026-08-07T15:41:07.779945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T13:44:20.452480Z","title":"The era of 1-bit LLMs: All large language models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21245","last_updated":"2025-05-27T14:25:33Z","snapshot_observed_at":"2026-08-07T13:30:31.980491Z","submitted_at":"2025-05-27T14:25:33Z","title":"Towards One-bit ASR: Extremely Low-bit Conformer Quantization Using Co-training and Stochastic Precision","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:44:20.452480Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2505.21245"},"observation_digest":"sha256:8389926ff67520eda9f341c81a8ef5858c42f4925d653d4e5e97634edb7ac1d2","observation_id":"7ac0e8c3-8980-4f1a-b4ed-17e7271a73a8","resolution":{"observed_at":"2026-08-07T13:44:20.452480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2505.22811","last_updated":"2026-04-21T08:01:39Z","snapshot_observed_at":"2026-08-05T01:41:20.121334Z","submitted_at":"2025-05-28T19:40:34Z","title":"Highly Efficient and Effective LLMs with Multi-Boolean Architectures","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2505.22811"},"observation_digest":"sha256:2d9758f8035f2ec21135f46e15d8fb6a274334466a3b848fc8a51f1a4029af4b","observation_id":"014e16a1-b4ea-4ef7-97ab-01a5432cd264","resolution":{"observed_at":"2026-05-19T12:42:18.014148Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T12:11:01.202720Z","title":"arXiv preprint arXiv:2402.17764 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00528","last_updated":"2025-05-31T12:22:24Z","snapshot_observed_at":"2026-08-10T10:18:15.478310Z","submitted_at":"2025-05-31T12:22:24Z","title":"Ultra-Quantisation: Efficient Embedding Search via 1.58-bit Encodings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.202720Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.00528"},"observation_digest":"sha256:18cdd7ed47af1ad985aef5b4fb82f88b7a385043222065710dc02debd2975aab","observation_id":"6122dbcf-038a-4938-ab2c-cba40786105b","resolution":{"observed_at":"2026-08-07T12:11:01.202720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T11:57:45.599535Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01140","last_updated":"2025-06-01T19:49:01Z","snapshot_observed_at":"2026-08-08T05:40:04.869075Z","submitted_at":"2025-06-01T19:49:01Z","title":"ReTern: Exploiting Natural Redundancy and Sign Transformations for Enhanced Fault Tolerance in Compute-in-Memory based Ternary LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:57:45.599535Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.01140"},"observation_digest":"sha256:7bba1d29f9c893984bf8d9395b87064e7cf52980f3eb2912f4d211164e7f9f7b","observation_id":"fe34546e-ff26-441d-a538-263c9d7a31ed","resolution":{"observed_at":"2026-08-07T11:57:45.599535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T11:07:15.936246Z","title":"The era of 1-bit llms: All large lan- guage models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03515","last_updated":"2025-06-04T03:02:18Z","snapshot_observed_at":"2026-08-08T02:14:58.494663Z","submitted_at":"2025-06-04T03:02:18Z","title":"BitTTS: Highly Compact Text-to-Speech Using 1.58-bit Quantization and Weight Indexing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:15.936246Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.03515"},"observation_digest":"sha256:634566c79ebf1142fcd6cb9cb71e6da3ccfcaffca6784ecad55b3dee41e69d88","observation_id":"84545911-dfa3-4c53-8391-f89bb49083ec","resolution":{"observed_at":"2026-08-07T11:07:15.936246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2506.06374","last_updated":"2026-04-20T13:03:47Z","snapshot_observed_at":"2026-07-06T21:38:10.885548Z","submitted_at":"2025-06-04T13:54:02Z","title":"SiLIF: Structured State Space Model Dynamics and Parametrization for Spiking Neural Networks","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T11:05:05.783726Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.06374"},"observation_digest":"sha256:88e9486ec88ef1dd760c97fc28431b5e46508e09df9e6063e85f0a6ebdfda484","observation_id":"c4a5bee6-7270-406f-96b0-cdef85c9aeae","resolution":{"observed_at":"2026-05-19T11:07:15.289121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T05:31:20.875138Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07900","last_updated":"2025-09-04T16:23:02Z","snapshot_observed_at":"2026-08-09T02:25:55.181285Z","submitted_at":"2025-06-09T16:16:50Z","title":"MiniCPM4: Ultra-Efficient LLMs on End Devices","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T05:31:20.875138Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.07900"},"observation_digest":"sha256:65fd0a2e15f0bed49a220b0ae7ceffe35eb7537b8fc2c7cb8379b8b78bd591ed","observation_id":"7d34dc5c-336d-4bd7-a94e-4299a4482785","resolution":{"observed_at":"2026-08-07T05:31:20.875138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-07T04:47:16.365607Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09581","last_updated":"2025-06-11T10:19:49Z","snapshot_observed_at":"2026-08-10T11:14:10.573003Z","submitted_at":"2025-06-11T10:19:49Z","title":"Integrating Quantized LLMs into Robotics Systems as Edge AI to Leverage their Natural Language Processing Capabilities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:47:16.365607Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.09581"},"observation_digest":"sha256:ecad3ca8d28a8fc2011281dc772ddc7d166e4fa569c637f425049415ef194eae","observation_id":"a1b3ffef-71cc-4b2a-b09b-6a9bbeeb543e","resolution":{"observed_at":"2026-08-07T04:47:16.365607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T21:58:34.684907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23025","last_updated":"2025-06-28T22:13:43Z","snapshot_observed_at":"2026-08-09T01:19:06.931322Z","submitted_at":"2025-06-28T22:13:43Z","title":"Spectra 1.1: Scaling Laws and Efficient Inference for Ternary Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T21:58:34.684907Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.23025"},"observation_digest":"sha256:d34e5e3c60aeaf4874369e74564e4cce755de711e4fd9da7d5688528db9f60e1","observation_id":"e6a8cc48-9708-4edd-af1d-e0d5f8486afb","resolution":{"observed_at":"2026-08-06T21:58:34.684907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T21:36:40.767790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23762","last_updated":"2025-06-30T12:09:29Z","snapshot_observed_at":"2026-08-06T21:29:49.550137Z","submitted_at":"2025-06-30T12:09:29Z","title":"Software Engineering for Large Language Models: Research Status, Challenges and the Road Ahead","version":1},"reference_index":233,"source":"pdf_text","source_observed_at":"2026-08-06T21:36:40.767790Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2506.23762"},"observation_digest":"sha256:41c4a43177b0c957ae11d802459b95ad01716cfe9eb1cc91c96cc3ad43cd4968","observation_id":"b38e8279-7910-48a2-8332-c385286c1364","resolution":{"observed_at":"2026-08-06T21:36:40.767790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T19:16:25.228170Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06079","last_updated":"2025-07-08T15:19:14Z","snapshot_observed_at":"2026-08-09T15:13:00.134450Z","submitted_at":"2025-07-08T15:19:14Z","title":"QS4D: Quantization-aware training for efficient hardware deployment of structured state-space sequential models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:16:25.228170Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2507.06079"},"observation_digest":"sha256:502022ff3fb90ccf0a632a22e363b3c32f2cd9ac8cf55c2406954675e0e21fc6","observation_id":"3ef31ab3-d958-4cce-b0bb-8418c5a03bcb","resolution":{"observed_at":"2026-08-06T19:16:25.228170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T17:45:20.837218Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10059","last_updated":"2025-07-14T08:44:59Z","snapshot_observed_at":"2026-08-09T09:16:27.763879Z","submitted_at":"2025-07-14T08:44:59Z","title":"GeLaCo: An Evolutionary Approach to Layer Compression","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:45:20.837218Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2507.10059"},"observation_digest":"sha256:94017c59ea0371a7ca9ae566cdc7c03158f0154b52da1d06a3f284fa4ad061f8","observation_id":"5d84c986-129c-4fd4-b835-8f89345a68ea","resolution":{"observed_at":"2026-08-06T17:45:20.837218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-06T17:05:45.053733Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12050","last_updated":"2025-07-16T09:10:40Z","snapshot_observed_at":"2026-08-11T04:37:00.051950Z","submitted_at":"2025-07-16T09:10:40Z","title":"IDFace: Face Template Protection for Efficient and Secure Identification","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:05:45.053733Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2507.12050"},"observation_digest":"sha256:00261424d82b0818ff0853f634a9295d2edbedc6c21c81b7da5696e34ee8c5bc","observation_id":"6be5ff3b-e4ce-4b64-95a0-70415c2308f4","resolution":{"observed_at":"2026-08-06T17:05:45.053733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2507.16079","last_updated":"2026-04-25T14:40:47Z","snapshot_observed_at":"2026-08-03T02:40:20.493603Z","submitted_at":"2025-07-21T21:29:33Z","title":"A Lower Bound for the Number of Linear Regions of Ternary ReLU Regression Neural Networks","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-19T03:27:12.956489Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2507.16079"},"observation_digest":"sha256:5021850fe614a9fc787266ff3f46881fe36fc0447e567389e597c5449f546d8b","observation_id":"0954d307-b23a-4dc3-bc57-344105274223","resolution":{"observed_at":"2026-05-19T03:32:01.762696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2508.06974","last_updated":"2026-05-18T12:47:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-09T13:00:16Z","title":"Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T23:44:01.953344Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2508.06974"},"observation_digest":"sha256:e65be38619214433cd7ff6116901ded12279d5e82cd879933bdb57d319b65383","observation_id":"960f05ba-c912-4153-9768-d97c5c8f7c9f","resolution":{"observed_at":"2026-05-21T23:44:26.580598Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2508.16703","last_updated":"2026-04-08T06:56:34Z","snapshot_observed_at":"2026-07-06T22:16:52.874707Z","submitted_at":"2025-08-22T07:41:35Z","title":"ShadowNPU: System and Algorithm Co-design for NPU-Centric On-Device LLM Inference","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-18T22:03:10.316005Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2508.16703"},"observation_digest":"sha256:ab6c7a41a4d20fa9c225c17c128260041b3dd0e531f2f3fd9d4753d9ef979ea5","observation_id":"fbe3254e-fe04-42e9-a748-c7b3257d7641","resolution":{"observed_at":"2026-05-18T22:06:52.222484Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T15:52:45.002146Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19432","last_updated":"2025-08-26T21:01:45Z","snapshot_observed_at":"2026-08-09T00:35:46.151432Z","submitted_at":"2025-08-26T21:01:45Z","title":"Quantized but Deceptive? A Multi-Dimensional Truthfulness Evaluation of Quantized LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:52:45.002146Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2508.19432"},"observation_digest":"sha256:59978cfacef64fe613459474a4d260563bc8efc584efc16a71f89af8d33dd7b4","observation_id":"c36f15e2-7215-42dc-9825-61c32a2ec28b","resolution":{"observed_at":"2026-08-05T15:52:45.002146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-04T19:10:41.622492Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09424","last_updated":"2025-09-11T13:04:22Z","snapshot_observed_at":"2026-08-08T11:03:44.357154Z","submitted_at":"2025-09-11T13:04:22Z","title":"ENSI: Efficient Non-Interactive Secure Inference for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T19:10:41.622492Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2509.09424"},"observation_digest":"sha256:331c5f67d6afc352631c3d8d528bdeb0096581aa93fb7a839ca19002fdaceaa1","observation_id":"6a5adeb0-ae94-4451-b8b8-197f23d13716","resolution":{"observed_at":"2026-08-04T19:10:41.622492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2509.23582","last_updated":"2026-05-21T15:51:47Z","snapshot_observed_at":"2026-08-02T07:34:06.312590Z","submitted_at":"2025-09-28T02:35:12Z","title":"RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-22T13:11:39.719989Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2509.23582"},"observation_digest":"sha256:7bb51a4de8630837ff1c9f20be98743471652cb448aeb07fafe459a0dffe10ac","observation_id":"bf9fd146-3feb-4195-8599-f66ebfd672e6","resolution":{"observed_at":"2026-05-22T13:14:53.404360Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2510.23912","last_updated":"2026-04-23T06:11:56Z","snapshot_observed_at":"2026-08-11T05:33:08.527140Z","submitted_at":"2025-10-27T22:39:34Z","title":"Key and Value Weights Are Probably All You Need: On the Necessity of the Query, Key, Value weight Triplet in Self-Attention Transformers","version":7},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T03:38:36.932424Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2510.23912"},"observation_digest":"sha256:b9e13d278566e4ebffbfe0c73f12010742d08026fc15b7cc44886eb595a33579","observation_id":"d3a83a0d-8caf-4976-a42d-d531587c0b4c","resolution":{"observed_at":"2026-05-18T03:40:50.552066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2512.06443","last_updated":"2026-04-14T07:55:36Z","snapshot_observed_at":"2026-08-07T01:10:46.412155Z","submitted_at":"2025-12-06T14:14:01Z","title":"Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-17T00:46:48.862313Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2512.06443"},"observation_digest":"sha256:4b8a398ccd862e23c6629e8851d6741acd5235e6052d264c8cb5b763215db22c","observation_id":"f1cef842-222b-4098-947c-da559c04ce88","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-03T09:32:55.265006Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 1(4), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.13563","last_updated":"2026-07-08T11:01:48Z","snapshot_observed_at":"2026-08-09T23:09:17.337084Z","submitted_at":"2026-01-20T03:39:33Z","title":"ButterflyMoE: Compression-Scalable Ternary Experts via Structured Butterfly Orbits","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T09:32:55.265006Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2601.13563"},"observation_digest":"sha256:4620bfc0f44c12635a6447b15f5d8ef7dbb62283f9d7b5045849b01a8106f0d5","observation_id":"d5b55fd8-4410-4da5-9220-8ee585d33059","resolution":{"observed_at":"2026-08-03T09:32:55.265006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-03T05:22:22.448661Z","title":"Ma, S., Wang, H., Ma, L., Wang, L., Wang, W., Huang, S., Dong, L., Wang, R., Xue, J., and Wei, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.02680","last_updated":"2026-06-03T22:04:11Z","snapshot_observed_at":"2026-08-09T20:39:08.038451Z","submitted_at":"2026-02-02T19:01:40Z","title":"FlexRank: Nested Low-Rank Knowledge Decomposition for Adaptive Model Deployment","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:22:22.448661Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2602.02680"},"observation_digest":"sha256:348fb3e53c756426104693aaebb0b639922c5e2d66bee675ba1b8a3e7384b14c","observation_id":"b0a5fbfe-cd90-43c3-b680-9c2addb12af4","resolution":{"observed_at":"2026-08-03T05:22:22.448661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-14T22:28:35.981853Z","title":"arXiv preprint arXiv:2402.17764 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.12506","last_updated":"2026-07-03T16:51:28Z","snapshot_observed_at":"2026-08-08T05:06:41.353423Z","submitted_at":"2026-03-12T22:51:39Z","title":"Na\\\"ive PAINE: Lightweight Text-to-Image Generation Improvement with Prompt Evaluation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T22:28:35.981853Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2603.12506"},"observation_digest":"sha256:ac7e2afeefdd4819b7caf27dfc322760609bfc4e3d7b6c84b9c3aa4240c541d8","observation_id":"25be9bda-b504-4dd6-9bb6-c6a746924fda","resolution":{"observed_at":"2026-07-14T22:28:35.981853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.03336","last_updated":"2026-04-08T03:25:35Z","snapshot_observed_at":"2026-07-06T22:52:34.609783Z","submitted_at":"2026-04-03T06:58:03Z","title":"NativeTernary: A Self-Delimiting Binary Encoding with Unary Run-Length Hierarchy Markers for Ternary Neural Network Weights, Structured Data, and General Computing Infrastructure","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T19:35:36.633437Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.03336"},"observation_digest":"sha256:e7a1a6ebbb5d45d992cfe523ac62af1f0323daf6bb0a7d302b29d3c882a55799","observation_id":"4ad78fbc-1d9b-4da5-be8b-71aa46d181d8","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.06836","last_updated":"2026-04-09T02:16:08Z","snapshot_observed_at":"2026-07-06T22:55:15.791334Z","submitted_at":"2026-04-08T08:57:09Z","title":"STQuant: Spatio-Temporal Adaptive Framework for Optimizer Quantization in Large Multimodal Model Training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:49:40.758234Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.06836"},"observation_digest":"sha256:f638b282390a0dca07df44117d019a235cc429902749de9b8fb69453bd4f3d30","observation_id":"1d293173-3f92-480b-bddd-e6d3bcc2850b","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.10272","last_updated":"2026-04-11T16:28:27Z","snapshot_observed_at":"2026-07-06T22:58:56.307161Z","submitted_at":"2026-04-11T16:28:27Z","title":"The Phase Is the Gradient: Equilibrium Propagation for Frequency Learning in Kuramoto Networks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-10T15:52:13.956464Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.10272"},"observation_digest":"sha256:f0f3681ab33e8fe6302cb5ae2dd9d1e37ecf47d6f546ff3268f27dbf1ae51df4","observation_id":"464d50a8-5f39-47cd-b092-af7f63aaf210","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.13806","last_updated":"2026-04-15T12:40:30Z","snapshot_observed_at":"2026-08-11T08:01:41.279570Z","submitted_at":"2026-04-15T12:40:30Z","title":"Robust Ultra Low-Bit Post-Training Quantization via Stable Diagonal Curvature Estimate","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T14:15:25.783283Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.13806"},"observation_digest":"sha256:cd8468ee56139452c52ceff4be062c94854c6c78ab58907f5e317da1004c7953","observation_id":"ed515efb-bd3a-4323-b22c-ec2218b81731","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.18976","last_updated":"2026-04-21T01:58:09Z","snapshot_observed_at":"2026-08-11T10:41:36.233612Z","submitted_at":"2026-04-21T01:58:09Z","title":"STAR-Teaming: A Strategy-Response Multiplex Network Approach to Automated LLM Red Teaming","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T03:06:21.624159Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.18976"},"observation_digest":"sha256:70ba7ca6cf57fc06986f4db5fcc43282e922dd085d6fdbb9d7d3aa3126d45e63","observation_id":"5ee7dbde-4379-404c-acb1-5c835287095f","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.20333","last_updated":"2026-05-08T04:10:30Z","snapshot_observed_at":"2026-08-04T04:33:41.176317Z","submitted_at":"2026-04-22T08:29:35Z","title":"Quantization robustness from dense representations of sparse functions in high-capacity kernel associative memory","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T23:10:20.534044Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.20333"},"observation_digest":"sha256:bee22d22aa2e69803dade2977dec5987c8734338e463f8e763f70df3acd5c020","observation_id":"bd600ad9-cf6e-4eff-9acc-706636361747","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.20333","last_updated":"2026-05-08T04:10:30Z","snapshot_observed_at":"2026-08-04T04:33:41.176317Z","submitted_at":"2026-04-22T08:29:35Z","title":"Quantization robustness from dense representations of sparse functions in high-capacity kernel associative memory","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T00:57:09.080491Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.20333"},"observation_digest":"sha256:31a3a0b23c8d84de80a3e217d785ed03e11522a8344ffca26149face002680f1","observation_id":"5a87311b-1080-4ca5-8234-a06ae805f0ae","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.20913","last_updated":"2026-04-22T02:42:10Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T02:42:10Z","title":"FairyFuse: Multiplication-Free LLM Inference on CPUs via Fused Ternary Kernels","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T01:15:51.105340Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.20913"},"observation_digest":"sha256:2ec8268a4f256c5e18d69a0655121c2461d9d37506cd59fd9064a89b29763c0d","observation_id":"e309450d-092c-483b-bc8f-15208be06ecb","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.21026","last_updated":"2026-04-24T07:54:05Z","snapshot_observed_at":"2026-08-11T00:28:28.451528Z","submitted_at":"2026-04-22T19:18:30Z","title":"MCAP: Deployment-Time Layer Profiling for Memory-Constrained LLM Inference","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T00:54:33.897112Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.21026"},"observation_digest":"sha256:03d286cfc51db7e45d64f90aa79b0e95c1804691331532196573bf19be5b3691","observation_id":"8490c713-c6ec-4942-bdee-b0df3ccf109c","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2604.27396","last_updated":"2026-04-30T04:07:21Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T04:07:21Z","title":"VitaLLM: A Versatile, Ultra-Compact Ternary LLM Accelerator with Dependency-Aware Scheduling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T09:05:12.937377Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2604.27396"},"observation_digest":"sha256:9c4c9850d9a482ab7c3d6237018c910f5b496079b4c2c3d4dd71bd1131ad362c","observation_id":"d3a7923e-39fc-4388-87e5-453db2fa3094","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.00320","last_updated":"2026-05-01T00:59:46Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T00:59:46Z","title":"VitaLLM: A Versatile and Tiny Accelerator for Mixed-Precision LLM Inference on Edge Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T19:06:18.309062Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.00320"},"observation_digest":"sha256:2cd796f77b64d276be5cdfaafc2d8fec4295ac4536b5c6024c22e81edee2270b","observation_id":"72609fdf-3313-4fae-8385-acce39de6da7","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.02853","last_updated":"2026-05-04T17:30:50Z","snapshot_observed_at":"2026-07-06T23:15:51.008483Z","submitted_at":"2026-05-04T17:30:50Z","title":"Trust, but Verify: Peeling Low-Bit Transformer Networks for Training Monitoring","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T19:36:16.254970Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.02853"},"observation_digest":"sha256:5d25059ac87b4e57a8957cd5d2353b3774ea7b7d51d6a7bdef3d46d33967fb00","observation_id":"10381feb-bc6b-47b0-9a1a-e23e74fc505e","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.06485","last_updated":"2026-06-10T14:41:46Z","snapshot_observed_at":"2026-08-09T19:15:08.038528Z","submitted_at":"2026-05-07T16:07:39Z","title":"Litespark Inference For CPUs: Ultra-Fast SIMD Framework for Ternary (1.58-bit) Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T10:12:36.972813Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.06485"},"observation_digest":"sha256:c0a143487bdd96798aafb152eacb24b2cd598ff2cfe0a231fbbbc68544b17f4e","observation_id":"836d318d-128e-44a9-9438-cd9ae7913c18","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.06485","last_updated":"2026-06-10T14:41:46Z","snapshot_observed_at":"2026-08-09T19:15:08.038528Z","submitted_at":"2026-05-07T16:07:39Z","title":"Litespark Inference For CPUs: Ultra-Fast SIMD Framework for Ternary (1.58-bit) Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T23:12:52.038253Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.06485"},"observation_digest":"sha256:e838347b7a3fa7244066138e98f01c519517655375a7ac1e52a9283d3c8e6fdd","observation_id":"9cc71374-f0b1-4eb4-a083-96ebcbeaeb1f","resolution":{"observed_at":"2026-07-01T13:25:46.097593Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.08894","last_updated":"2026-05-15T02:06:51Z","snapshot_observed_at":"2026-08-11T02:03:47.090296Z","submitted_at":"2026-05-09T11:19:51Z","title":"Fitting Is Not Enough: Smoothness in Extremely Quantized LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T01:18:31.979565Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.08894"},"observation_digest":"sha256:63d1eb4d39948a6593a297802ad14780fd3d583b292645c7474160d369f39bae","observation_id":"f9fe3a1f-dbce-4205-b62e-9c5dd36d1600","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.08894","last_updated":"2026-05-15T02:06:51Z","snapshot_observed_at":"2026-08-11T02:03:47.090296Z","submitted_at":"2026-05-09T11:19:51Z","title":"Fitting Is Not Enough: Smoothness in Extremely Quantized LLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T15:16:57.476191Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.08894"},"observation_digest":"sha256:cbb4ac52cd2656deb1498e53704c75ab4f6e8f8ddc2323229b09264e2c4dfe98","observation_id":"166da4d3-49f2-44c3-98e2-4522fbe98242","resolution":{"observed_at":"2026-05-19T15:17:37.527155Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.11558","last_updated":"2026-05-12T05:41:36Z","snapshot_observed_at":"2026-08-09T00:11:26.040411Z","submitted_at":"2026-05-12T05:41:36Z","title":"A Composite Activation Function for Learning Stable Binary Representations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T02:03:42.456988Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.11558"},"observation_digest":"sha256:4ed0294be5380502eef8f1a9aafc224a91c33849313990055e5b90b5bdda989d","observation_id":"6e03f6e3-717a-445a-902d-722081bb3e85","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.13538","last_updated":"2026-05-13T13:47:11Z","snapshot_observed_at":"2026-08-10T10:22:42.651990Z","submitted_at":"2026-05-13T13:47:11Z","title":"Locale-Conditioned Few-Shot Prompting Mitigates Demonstration Regurgitation in On-Device PII Substitution with Small Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T19:06:02.320101Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.13538"},"observation_digest":"sha256:61dbaa17915bc1ff3bf30eb63a158d307e44cf8c07f37f131924bca87db5ac8f","observation_id":"9425f2f0-906e-46bf-af51-41ca8b98e9ef","resolution":{"observed_at":"2026-05-17T20:11:43.638959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.21171","last_updated":"2026-05-20T13:41:53Z","snapshot_observed_at":"2026-07-06T23:31:37.061253Z","submitted_at":"2026-05-20T13:41:53Z","title":"FTerViT: Fully Ternary Vision Transformer","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T05:59:54.807460Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.21171"},"observation_digest":"sha256:0ceda72a943426e39417e4988e60fbcd8771ab8dff66eff15ada3c73018dbde5","observation_id":"693f5d19-a2a8-4917-a3ff-55522992988a","resolution":{"observed_at":"2026-05-21T06:03:59.456305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.22086","last_updated":"2026-05-21T07:27:22Z","snapshot_observed_at":"2026-07-06T23:32:25.286443Z","submitted_at":"2026-05-21T07:27:22Z","title":"GenHAR: Generalizing Cross-domain Human Activity Recognition for Last-mile Delivery","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T07:42:29.916098Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.22086"},"observation_digest":"sha256:0ceef8b2ca865e3ef8c4ef7e0cec4263d8b0de30658a24db8a728dd4a44d0f03","observation_id":"5fa1c8b0-b65e-449a-bc17-a7681966d91a","resolution":{"observed_at":"2026-05-22T07:44:42.785698Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.25203","last_updated":"2026-05-24T18:05:37Z","snapshot_observed_at":"2026-08-04T10:11:25.132076Z","submitted_at":"2026-05-24T18:05:37Z","title":"Influence-Inspired Spectral Rotations for Extreme Low-Bit LLM Quantization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T12:13:18.805668Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.25203"},"observation_digest":"sha256:7af0406d0b5514259fcfe4c8df02b3931778735c731d4753f934d439fbf04b06","observation_id":"55209456-02c5-418b-9fe6-9b69ec285f3c","resolution":{"observed_at":"2026-06-30T12:14:39.059372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2605.25966","last_updated":"2026-05-25T15:42:34Z","snapshot_observed_at":"2026-08-03T22:27:49.482944Z","submitted_at":"2026-05-25T15:42:34Z","title":"Mapping the Schedule x Bit-Width Boundary in Sub-100M Quantisation-Aware Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T23:10:47.199537Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2605.25966"},"observation_digest":"sha256:1e0beba3997319c1b9cea56ea55dfa7058bef2e67637dcc461f3a4148d052be3","observation_id":"f1eaa6cd-2040-446d-8591-a3d89c6c023b","resolution":{"observed_at":"2026-06-29T23:14:01.495386Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.00365","last_updated":"2026-05-29T21:07:27Z","snapshot_observed_at":"2026-07-06T23:41:05.637982Z","submitted_at":"2026-05-29T21:07:27Z","title":"SPARQLe: Sub-Precision Activation Representation for Quantized LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T19:31:28.053090Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.00365"},"observation_digest":"sha256:cd81ebcea9d246470bfc939b563c74f0540f99ff4d47cead347390c375058f48","observation_id":"f7a25855-6dc4-4ee3-adff-9ce9641e0a43","resolution":{"observed_at":"2026-06-28T19:32:34.313163Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.05017","last_updated":"2026-06-22T12:03:17Z","snapshot_observed_at":"2026-08-08T21:46:25.128578Z","submitted_at":"2026-06-03T15:41:16Z","title":"GoldenFloat: A Phi-Derived Static-Split Floating-Point Family from GF4 to GF1024 with a Lucas-Exact Integer Identity","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T03:47:27.000639Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.05017"},"observation_digest":"sha256:8efab9569beb00b8a24c92ff2c5f4f794f259f52a8d2bb7e8de2ca054cec2283","observation_id":"c80f822a-f785-4574-905e-ae327d1f96c9","resolution":{"observed_at":"2026-07-02T11:26:54.605576Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.05271","last_updated":"2026-06-03T17:09:41Z","snapshot_observed_at":"2026-08-01T20:07:03.702960Z","submitted_at":"2026-06-03T17:09:41Z","title":"BIDENT: Heterogeneous Operator-level Mapping for Efficient Edge Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T03:38:26.132412Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.05271"},"observation_digest":"sha256:b4bbaab44d3458e07d81cc4b01635cde56f0e4c5da131fe501c7194bf19d2b64","observation_id":"b5057fc8-cfd2-4ef6-9216-2945e7c38973","resolution":{"observed_at":"2026-07-02T11:26:54.831767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.10932","last_updated":"2026-04-28T14:25:10Z","snapshot_observed_at":"2026-08-06T07:28:00.654805Z","submitted_at":"2026-04-28T14:25:10Z","title":"Density Field State Space Models: 1-Bit Distillation, Efficient Inference, and Knowledge Organization in Mamba-2","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T08:55:37.926334Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.10932"},"observation_digest":"sha256:542a501165552aecf9df2ce4b112d78dd5af2675e794fbb44cce762d89487379","observation_id":"4c189ff4-0c09-4710-bccc-3c965af231d7","resolution":{"observed_at":"2026-07-01T09:05:37.116532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.18114","last_updated":"2026-06-16T16:18:21Z","snapshot_observed_at":"2026-08-10T03:43:48.869220Z","submitted_at":"2026-06-16T16:18:21Z","title":"Ternary Mamba: Grouped Quantization-Aware Training of W1.58A16 State Space Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T00:55:02.737906Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.18114"},"observation_digest":"sha256:6b32e4f3498cbd396c80735ae27343eafa5d285082d855f0f1d274ba2d9f1794","observation_id":"2dc1e227-54ff-473f-9b83-ca43f32b3fee","resolution":{"observed_at":"2026-07-03T21:08:58.131885Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.25674","last_updated":"2026-07-22T12:59:40Z","snapshot_observed_at":"2026-08-02T10:15:52.954015Z","submitted_at":"2026-06-24T10:37:01Z","title":"BitNet Text Embeddings","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-25T20:48:30.687676Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.25674"},"observation_digest":"sha256:977cf7390d051d5691a611459dc43961c7d2e95cef8ce9a89b93de716726fee0","observation_id":"9695c930-2ab3-4cd7-98c9-17e9beb325e2","resolution":{"observed_at":"2026-07-04T20:00:08.944099Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-02T10:15:53.789980Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.25674","last_updated":"2026-07-22T12:59:40Z","snapshot_observed_at":"2026-08-02T10:15:52.954015Z","submitted_at":"2026-06-24T10:37:01Z","title":"BitNet Text Embeddings","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T10:15:53.789980Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.25674"},"observation_digest":"sha256:41058ce5a5a0071988075a900efe5e4162227c0ebb38be3f8e4c441e9beffa50","observation_id":"7db72f83-fca9-478a-a924-a376b05b1056","resolution":{"observed_at":"2026-08-02T10:15:53.789980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":"2402.17764","doi":"10.18653/v1/2023.acl-long.5","metadata_source":"pith","pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","venue":"cs.CL","work_id":"4a49f413-bca9-4de8-8620-97aa4cb099f3","year":2024},"citing_paper":{"arxiv_id":"2606.26650","last_updated":"2026-06-25T06:24:02Z","snapshot_observed_at":"2026-08-07T13:58:30.530066Z","submitted_at":"2026-06-25T06:24:02Z","title":"CAT-Q: Cost-efficient and Accurate Ternary Quantization for LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T05:21:12.916984Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2606.26650"},"observation_digest":"sha256:ab6421b7268478a18700614f6804f1813fc8107e580c50b562ecb37a346befa1","observation_id":"3bb1a515-9023-483c-a469-f2032b8a8041","resolution":{"observed_at":"2026-07-04T13:19:50.564261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-12T06:20:07.112455Z","title":"The era of 1-bit LLMs: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02893","last_updated":"2026-07-03T02:42:04Z","snapshot_observed_at":"2026-08-06T14:41:53.505619Z","submitted_at":"2026-07-03T02:42:04Z","title":"Variable Bit-width Quantization: Learning Per-Group Precision for \"Bigger-but-Smaller\" Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-12T06:20:07.112455Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.02893"},"observation_digest":"sha256:4f7a46c1bf2f7feb39a7a869f89fe03d8761079210a2a414a1ddc2260ab9b369","observation_id":"e0b92520-541d-4826-998f-2acfe0ed7675","resolution":{"observed_at":"2026-07-12T06:20:07.112455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-12T00:55:09.690245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03652","last_updated":"2026-07-04T00:52:06Z","snapshot_observed_at":"2026-08-07T04:49:22.708900Z","submitted_at":"2026-07-04T00:52:06Z","title":"ELiTeFormer: An Efficient Transformer for FPGAs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-12T00:55:09.690245Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.03652"},"observation_digest":"sha256:6bba5a6ad23720b863766939b7a22965f492a63d43ae7b9f4041c24797b43b6c","observation_id":"4d905e8e-9afc-4f10-9072-1676698c4b37","resolution":{"observed_at":"2026-07-12T00:55:09.690245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2402.17764 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-06T03:10:18.618115Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:60f57839df28e73f73d3d1d25a301fa9ec613b96e21f43b017c0be6876477a20","observation_id":"55c22b52-a722-479b-8ce9-343ed57b45d5","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-02T05:02:32.482313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13511","last_updated":"2026-07-15T07:04:32Z","snapshot_observed_at":"2026-08-09T18:22:29.760947Z","submitted_at":"2026-07-15T07:04:32Z","title":"ExTernD: Expanded-Rank Ternary Decomposition Ternary LLM PTQ with Accuracy Approaching Any Quantization Level","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T05:02:32.482313Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.13511"},"observation_digest":"sha256:f751f97ea6307a52f18b5f5ab687f79bf1b78f0d4aec07cbbb88e5c04b522b61","observation_id":"0d0836ca-4e65-4ccd-b7a5-d76e4334c752","resolution":{"observed_at":"2026-08-02T05:02:32.482313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-02T01:35:43.203227Z","title":"Ma et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14630","last_updated":"2026-07-16T06:47:52Z","snapshot_observed_at":"2026-08-08T01:00:35.370812Z","submitted_at":"2026-07-16T06:47:52Z","title":"Cross-Layer Error Compensation and Finite-Sample Feature-Statistics Matching for Extreme Low-Bit Quantization of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T01:35:43.203227Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.14630"},"observation_digest":"sha256:09231ca77b03503d2b09347e770c26212c6c812638207496fefb1759620ffcfa","observation_id":"ba88d05a-0909-488b-aece-4d58cc9356ac","resolution":{"observed_at":"2026-08-02T01:35:43.203227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-01T19:14:24.564799Z","title":"CoRR abs/2402.17764","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17090","last_updated":"2026-07-19T06:02:43Z","snapshot_observed_at":"2026-08-10T04:40:32.971796Z","submitted_at":"2026-07-19T06:02:43Z","title":"Expressivity of Shallow Neural Networks Over Finite Fields","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:14:24.564799Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.17090"},"observation_digest":"sha256:f54f865ea685d9f44ad77cc49b681783c708a1201471411bc2d56d6cdf62d5e3","observation_id":"8176a0fe-ea8c-4468-8527-d81641befe1b","resolution":{"observed_at":"2026-08-01T19:14:24.564799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-01T15:53:53.548518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18150","last_updated":"2026-07-20T16:50:15Z","snapshot_observed_at":"2026-08-08T03:46:42.162753Z","submitted_at":"2026-07-20T16:50:15Z","title":"Lossless-INR: Lossless Volumetric Implicit Neural Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:53:53.548518Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.18150"},"observation_digest":"sha256:87ce249b0a90ce4563605cb436cd00abbf026b6c261bf1212a9604552ed138f3","observation_id":"5a60e36d-94c4-45ce-afba-15144cbbb758","resolution":{"observed_at":"2026-08-01T15:53:53.548518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-01T08:38:52.748885Z","title":"arXiv preprint arXiv:2402.17764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21063","last_updated":"2026-07-23T08:56:11Z","snapshot_observed_at":"2026-08-07T01:50:19.863208Z","submitted_at":"2026-07-23T08:56:11Z","title":"QuantiBias: Benchmarking Quantization-Induced Bias in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T08:38:52.748885Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.21063"},"observation_digest":"sha256:ac8e5c59490be39db4777bf780db9a524c7b2a3bc437f8a21d79083453f933d1","observation_id":"2f910ed4-2455-4295-a3ef-32b77fa34744","resolution":{"observed_at":"2026-08-01T08:38:52.748885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-01T08:35:25.612348Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits.arXiv preprint arXiv:2402.17764, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21075","last_updated":"2026-07-25T09:14:28Z","snapshot_observed_at":"2026-08-06T08:39:08.267709Z","submitted_at":"2026-07-23T09:08:04Z","title":"VibeVoice-ASR-BitNet Technical Report","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T08:35:25.612348Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.21075"},"observation_digest":"sha256:2c5ca27b77b768ac9a26e9a451af8d6774025de7894b9f1c4d727d97a43fcc1f","observation_id":"5fc3c17c-e495-4a2e-a2f7-757e08f1c24a","resolution":{"observed_at":"2026-08-01T08:35:25.612348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-07-30T23:38:38.673762Z","title":"The era of 1-bit LLMs : All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23390","last_updated":"2026-07-25T23:29:23Z","snapshot_observed_at":"2026-08-06T08:16:43.110012Z","submitted_at":"2026-07-25T23:29:23Z","title":"When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation","version":1},"reference_index":166,"source":"arxiv_source","source_observed_at":"2026-07-30T23:38:38.673762Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.23390"},"observation_digest":"sha256:0458d30663d538038c48736a4633ec776451f56c14b5966150f58bf47c05accb","observation_id":"a1f4feff-fa9f-44e5-8f4b-c870502eee3a","resolution":{"observed_at":"2026-07-30T23:38:38.673762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-01T16:42:33.201358Z","title":"arXiv preprint arXiv:2402.17764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26404","last_updated":"2026-07-29T02:35:55Z","snapshot_observed_at":"2026-08-03T19:06:45.585998Z","submitted_at":"2026-07-29T02:35:55Z","title":"Examining the Efficacy of Graph Neural Network Message-Passing in Regression Contexts","version":1},"reference_index":261,"source":"arxiv_source","source_observed_at":"2026-08-01T16:42:33.201358Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.26404"},"observation_digest":"sha256:156b9cfd7e9b695fcddbdc9965683f9b15c0fd0de59d444f1c966e03d2df27a2","observation_id":"403e8a0f-8a21-4b27-9a08-1ce73f75dd6b","resolution":{"observed_at":"2026-08-01T16:42:33.201358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-03T07:51:21.978765Z","title":"arXiv preprint arXiv:2402.17764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-07T23:39:15.799185Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T07:51:21.978765Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:4c001a7b6d53c339e57e92e4b4adb936fb4fd6c789095ebd564843c57c05d855","observation_id":"1e3ad888-4077-4f95-bc9e-c6abf41c0a6b","resolution":{"observed_at":"2026-08-03T07:51:21.978765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-05T04:25:21.981921Z","title":"arXiv preprint arXiv:2402.17764 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-07T23:39:15.799185Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.981921Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:fa5770539ce82aa3078ace5767894ed3b07edb624373b86d2168049f5a1a80ee","observation_id":"fff4e2a5-5f11-4050-af5a-dcd1da594190","resolution":{"observed_at":"2026-08-05T04:25:21.981921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-08T17:34:28.084656Z","title":"The Era of 1-Bit","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05240","last_updated":"2026-08-05T14:04:50Z","snapshot_observed_at":"2026-08-10T00:46:32.997383Z","submitted_at":"2026-08-05T14:04:50Z","title":"One Qubit Can Beat One Bit: Quantum Advantage for Post-Training Quantization","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T17:34:28.084656Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2608.05240"},"observation_digest":"sha256:03c01511c45cdf7c5b6cf8ae0ce0673aaf795443f3b78fb739273b34118cdf0b","observation_id":"a13d1009-2d7c-464f-aebc-b95169820873","resolution":{"observed_at":"2026-08-08T17:34:28.084656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.17764/citation-record","integrity":"/paper/2402.17764/integrity","json":"/paper/2402.17764/citation-record.json","paper":"/paper/2402.17764"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":"1911.11641","doi":"10.48550/arxiv.1911.11641","metadata_source":"pith","pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","venue":"cs.CL","work_id":"0d865a62-6376-4606-8d3a-eeb3b6e9ba6d","year":2019},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:89ca05c2c92b285a6b8ae2c78d17e570da311e532ff51db851fed30b5aacf569","observation_id":"6ed7758e-8f28-40bc-b6e5-3ef79e985736","resolution":{"observed_at":"2026-05-17T20:11:43.579176Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13304","last_updated":"2024-01-15T21:54:28Z","snapshot_observed_at":"2026-08-07T08:10:21.413901Z","submitted_at":"2023-07-25T07:44:06Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","version":2},"cited_work":{"arxiv_id":"2307.13304","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.13304","snapshot_observed_at":"2026-07-04T10:29:45.542647Z","title":"QuIP: 2-bit quantization of large language models with guarantees","venue":null,"work_id":"bd3fe3b4-ccc3-419b-969e-9a80ded56858","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2307.13304","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:02d9c5b5b25f9b89793c2d11365de6d320cc0a5f065ec598e95737a79f3bdd80","observation_id":"ebe2dd47-76ea-4ae0-8eab-1ef0591b80c7","resolution":{"observed_at":"2026-05-17T20:11:43.587320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":"1905.10044","doi":"10.48550/arxiv.1905.10044","metadata_source":"pith","pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":"cs.CL","work_id":"511eeb84-4b95-46d5-b14f-50da43f4f19f","year":2019},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:dc0ff3839386e5dec965bf3391f7ab5b2fa15baf08baf1c2beda30cffc36a79f","observation_id":"748af0af-8307-4d6c-8294-999daa0e1f98","resolution":{"observed_at":"2026-05-17T20:11:43.592820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"1.1 computing’s energy problem (and what we can do about it)","venue":null,"work_id":"85c69f95-61c6-46d7-a2cd-7076728504f6","year":2014},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:a6e6679d0d76496a57801f7d0b0239fd8c3e0559c8eac2e4cc34b983698c0927","observation_id":"d95a5740-8aac-4239-8d4c-9c5b0dc8b239","resolution":{"observed_at":"2026-05-17T20:11:43.628840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00978","last_updated":"2026-04-25T06:58:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T17:59:10Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","version":6},"cited_work":{"arxiv_id":"2306.00978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.00978","snapshot_observed_at":"2026-07-10T11:17:03.640788Z","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","venue":"cs.CL","work_id":"ea9d1d72-db24-4cae-8c89-4ecd83dd87c1","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2306.00978","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:1b4f5f29800dd2406c7a440e03ce026ddaed675dd524abcea9bd2b4fe409fb7c","observation_id":"a4b37a48-0e5e-488d-b708-90e236006bbd","resolution":{"observed_at":"2026-05-17T20:11:43.613495Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":"1809.02789","doi":"10.48550/arxiv.1809.02789","metadata_source":"pith","pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","venue":"cs.CL","work_id":"b9d68fc0-5b23-4def-bc5e-6ad71d64eec6","year":2018},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:e591801d04ea93b59b3485c88d13b3d960c2a8a723da633bbba1f0d5d7ade703","observation_id":"1c419be6-b123-48e5-9496-e9a9e191bd9d","resolution":{"observed_at":"2026-05-17T20:11:43.617671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","venue":null,"work_id":"53a639b6-5c1f-458d-b78f-1237d6ceedcf","year":2016},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:e0688da60c15fb601640ebf3efa74899966fa3da4253977fe4d8cc1f7bfba045","observation_id":"bcc91c43-f4f7-4bb4-b316-08043777029a","resolution":{"observed_at":"2026-05-17T20:11:43.638060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":"1910.10683","doi":"10.18653/v1/2020.acl-main.259","metadata_source":"pith","pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","venue":"cs.LG","work_id":"50e3b368-0243-4726-8186-233869802ad1","year":2019},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:0ecfc155bbf0e68495704ace8a387969579602a995a82f4f3c81404e200d6274","observation_id":"673bde67-6f19-40a8-b307-831406d2df90","resolution":{"observed_at":"2026-05-17T20:11:43.621702Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-08-11T06:21:56.129166Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:cb28e581a0591ead30d34036d53d8e7b5fe43ba72220a195d8df451997e4ec80","observation_id":"f7ce7652-0189-4e66-b47f-c0ccaf36028f","resolution":{"observed_at":"2026-05-17T20:11:43.625496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04396","last_updated":"2024-06-04T04:51:52Z","snapshot_observed_at":"2026-08-10T20:22:11.583524Z","submitted_at":"2024-02-06T20:52:12Z","title":"QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks","version":2},"cited_work":{"arxiv_id":"2402.04396","doi":"10.48550/arxiv.2402.04396","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04396","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Quip#: Even better llm quantization with hadamard incoherence and lattice codebooks.arXiv preprint arXiv:2402.04396","venue":"arXiv (Cornell University)","work_id":"921fbb92-5d63-4c93-bb32-b74fe6f12ff8","year":2024},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2402.04396","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:a91fcef2167b99089704903f01803a2b66124d3d851d566ddf172fc215826145","observation_id":"28701e4b-a19a-4ee3-8cbf-e3743c6ad444","resolution":{"observed_at":"2026-05-17T20:11:43.597896Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:dce4c8fb9db1981678a8e3220d039aec1700bbcda56991c95b4546061307dd62","observation_id":"7c51eeda-e3b8-4611-8952-cd8fe81bbc3d","resolution":{"observed_at":"2026-05-17T20:11:43.601830Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:9fe5ac9e005259dccc165fdc9af6a43abac363612b6c2fad3ecda8087f8e16a7","observation_id":"10e746fe-ad1f-4327-a580-3bf189ee2d7c","resolution":{"observed_at":"2026-05-17T20:11:43.605815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu, and Matt Gardner","venue":null,"work_id":"7b381988-e018-4d09-b379-92dc2f3a7e12","year":2017},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:773290d81a4fd06674a69bcce43b9849f7fba7e81601c6df0cff5df3a61874df","observation_id":"52093775-c8de-44d3-9c9d-79444cc69ebc","resolution":{"observed_at":"2026-05-17T20:11:43.635116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11453","last_updated":"2023-10-17T17:59:15Z","snapshot_observed_at":"2026-08-11T03:44:43.109946Z","submitted_at":"2023-10-17T17:59:15Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","version":1},"cited_work":{"arxiv_id":"2310.11453","doi":"10.48550/arxiv.2310.11453","metadata_source":"pith","pith_arxiv_id":"2310.11453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BitNet: Scaling 1-bit Transformers for Large Language Models","venue":"cs.CL","work_id":"28ad8f61-4291-4894-b120-1d42fc9937a3","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"cited_paper":"/paper/2310.11453","citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:fae3ddaad0f27ac847e49826bf11f47a109929fd9bc1f716e3c0f5b63e56e422","observation_id":"21ee2189-913e-44dd-a16b-bdbb9b3e81bd","resolution":{"observed_at":"2026-05-17T20:11:43.609612Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SmoothQuant: accurate and efficient post-training quantization for large language models","venue":null,"work_id":"25d2818e-5578-4dd6-9050-c6ce64007b55","year":2023},"citing_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T20:11:43.559035Z"},"links":{"citing_paper":"/paper/2402.17764"},"observation_digest":"sha256:5c792b5dd5777df7b76d626e15a8e9494d62b09bdb9fc2f21bfd18ed046e6925","observation_id":"3e29fde8-2272-401c-8852-8af0206b19f3","resolution":{"observed_at":"2026-05-17T20:11:43.632013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":11,"verified_fuzzy":4},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 81 inbound Pith citation observations for arXiv:2402.17764."}