{"as_of":"2026-08-16T10:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:083790569b40223617f9b1d00a25ae3bdad21d61c805b7c4ce9d52866a0bdda1","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:46:23.218413Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.08981/citation-record","integrity":"/paper/2505.08981/integrity","json":"/paper/2505.08981/citation-record.json","paper":"/paper/2505.08981"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.118998Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.118998Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:4f3cc1aab7e76387bc22e8d829056d760186556eddb2d68df81525a8d032a8a6","observation_id":"dbd54209-21f3-4fed-9405-838acd6c5b68","resolution":{"observed_at":"2026-08-15T21:46:23.118998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.560095Z","title":"M4bram: Mixed-precision matrix-matrix multiplication in fpga block rams","venue":null,"work_id":"883da0b6-4c76-4969-958d-e41d82a7a8ac","year":2023},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.124499Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:a46ab6a95b4992fac888683608fc45d6b8da4addd6d5f515778c8c8184134dbc","observation_id":"c6beb585-68ae-4fd4-a4b5-558043069dde","resolution":{"observed_at":"2026-08-15T21:46:23.564892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.545048Z","title":"Msd: Mixing signed digit representations for hardware-efficient dnn acceleration on fpga with heterogeneous resources","venue":null,"work_id":"561a690d-25ad-4ef5-9384-c5f127b2abf7","year":2023},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.129585Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:65261e1d24c9d663aaf9db047afb00a4c2bc2adb9a43aee6832246d029aa6332","observation_id":"b1d16bfc-9ecb-420f-b000-ed94bec445ba","resolution":{"observed_at":"2026-08-15T21:46:23.549970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.529634Z","title":"Democratizing neural ma- chine translation with OPUS-MT","venue":null,"work_id":"44906e2e-ef73-4ce5-9880-1bda18f6a1f7","year":2023},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.134568Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:82363ebe19ff92ac49e485252120a389de1df3c588646a741f9e9a204043eca1","observation_id":"dee71ee8-47f8-45c7-afa4-e18926d0dec5","resolution":{"observed_at":"2026-08-15T21:46:23.534855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.139139Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.139139Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:2acd8ac9bc94269e593fb9e1eb76f1b43c7a947e48c4a7fc5f7e2e0de585e8df","observation_id":"ad9b9f58-fb11-4ec6-9f3c-1c534041a094","resolution":{"observed_at":"2026-08-15T21:46:23.139139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.501796Z","title":"Qllm: Accurate and efficient low-bitwidth quantization for large language models, 2024","venue":null,"work_id":"a2fc1c37-e3a8-48ed-a099-30f9d7f37e31","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.144367Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:8d92d2d9e39fba488b6a415c35d1ed2b7a762ee4a2b04745819e7772ce50411e","observation_id":"b3fff66a-3173-4584-9548-a39e5e29db75","resolution":{"observed_at":"2026-08-15T21:46:23.506708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.484342Z","title":"Efficient arbitrary precision acceleration for large language models on gpu tensor cores, 2024","venue":null,"work_id":"c0e84b62-18d8-4716-908e-6f37a58c07f5","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.149667Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:d240f0dc1109f49b9b5fb688f2c2a79372216c930f8e70c64a6316e68777c18f","observation_id":"6f3fc791-5796-4577-a26e-910f529db4d2","resolution":{"observed_at":"2026-08-15T21:46:23.489205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.468706Z","title":"Q8bert: Quantized 8bit bert","venue":null,"work_id":"a373bf00-2814-4868-b3dc-2c1ec2de7044","year":2019},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.154624Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:e4795d5dc4a4b043cf1d638a72a758dd7465cd8406eeca2aa0a97527af86fa86","observation_id":"e4898226-3c6f-4410-be4d-42511c865935","resolution":{"observed_at":"2026-08-15T21:46:23.474136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.453470Z","title":"Q-bert: Hessian based ultra low precision quantization of bert","venue":null,"work_id":"b090c5ef-d4c8-4cbf-8870-41cba25daf00","year":2020},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.159208Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:7376f48911ed1d9feed9d6e88429cd72aa4d21faded341bc1472f5ff2665c698","observation_id":"aac596a7-35fc-41dd-b2d3-efa5553c8959","resolution":{"observed_at":"2026-08-15T21:46:23.458192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.437645Z","title":"Owq: Outlier-aware weight quantization for efficient fine-tuning and inference of large language models","venue":null,"work_id":"aa91adbc-0853-4377-a07b-63755e94dc76","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.163729Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:449e22b9072586d1f2117ee8d4c2fac801ebbc57d68e9d16516540d6e897cf2a","observation_id":"09eb866a-4af7-47ea-b2e4-40e00e3fa77b","resolution":{"observed_at":"2026-08-15T21:46:23.443008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.168431Z","title":"Hawq: Hessian aware quantization of neural networks with mixed-precision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.168431Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:7aa77a5b17e4d9fc31ba43fa673a5390168a4b80b9153f2e33793b66f228d228","observation_id":"96c12863-bda7-490f-a7ff-1c3cdec005a2","resolution":{"observed_at":"2026-08-15T21:46:23.168431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"cited_work":{"arxiv_id":"2411.11745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11745","snapshot_observed_at":"2026-08-15T21:46:23.280942Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","venue":"cs.LG","work_id":"88265e88-f3d4-4b5a-8279-03819c67950c","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.173339Z"},"links":{"cited_paper":"/paper/2411.11745","citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:63a06daf0a4d6e2fdc1ab0fd03db2a6fa6aa28319e0dce658935b097743b365a","observation_id":"f4ac93e7-a401-4204-8c39-840f13031454","resolution":{"observed_at":"2026-08-15T21:46:23.285813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.410324Z","title":"Optimizing bit-serial matrix multiplica- tion for reconfigurable computing","venue":null,"work_id":"2782ae2e-3263-47ad-8194-f527e01767cb","year":2019},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.178681Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:6653da6e72269a8eb73d50029266fe1d983753b98290422d2db1c7b5e4ec38d9","observation_id":"51426ebb-e62d-4c45-9137-6b920764db9b","resolution":{"observed_at":"2026-08-15T21:46:23.415450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.394895Z","title":"Hihispmv: Sparse matrix vector multiplication with hierarchical row reductions on fpgas with high bandwidth memory","venue":null,"work_id":"edc35fe4-3b36-4064-ad67-251520033f09","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.183581Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:96ea78d08710da1a13696fa7225041b2e54d22f484ad9951a4886963f9df5f47","observation_id":"60f872e6-3a1f-403a-a971-02abb297cd71","resolution":{"observed_at":"2026-08-15T21:46:23.399802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03088","last_updated":"2024-06-05T09:25:18Z","snapshot_observed_at":"2026-08-13T06:33:03.170732Z","submitted_at":"2024-06-05T09:25:18Z","title":"HASS: Hardware-Aware Sparsity Search for Dataflow DNN Accelerator","version":1},"cited_work":{"arxiv_id":"2406.03088","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03088","snapshot_observed_at":"2026-08-15T21:46:23.256155Z","title":"HASS: Hardware-Aware Sparsity Search for Dataflow DNN Accelerator","venue":"cs.AR","work_id":"94bdae7c-c2dc-4014-bb39-aced20b7778e","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.188585Z"},"links":{"cited_paper":"/paper/2406.03088","citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:ae75fe15e186cb2625bb11813f7500e3580828cbdef2b29ca9e73c85015f5219","observation_id":"ad0b3b13-9f5f-4fd5-97c6-07321e878da9","resolution":{"observed_at":"2026-08-15T21:46:23.263510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.379366Z","title":"Adaptable butterfly accelerator for attention-based nns via hardware and algorithm co-design","venue":null,"work_id":"18b355d6-bef4-4655-a6ae-09b208ee58f2","year":2022},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.193857Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:52096c3b377fcd197e5fe1de588ff54ae8ac863376918a74b38c90f74e79e67c","observation_id":"90de80ed-2264-47ba-883d-ce89c42b9af4","resolution":{"observed_at":"2026-08-15T21:46:23.384463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.360910Z","title":"Streamsvd: Low-rank ap- proximation and streaming accelerator co-design","venue":null,"work_id":"da61c0c5-caac-4acd-bf8b-896d380b77d3","year":2021},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.200030Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:e2d524f27f4bc3462f45e6b2233c271f359f474a64f9af4d7030608672713ba3","observation_id":"275824aa-a5a4-4876-a287-29f5aae853ee","resolution":{"observed_at":"2026-08-15T21:46:23.366096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.343788Z","title":"Charm: Composing heterogeneous accelerators for matrix multiply on versal acap architec- ture, 2023","venue":null,"work_id":"721c5463-02a1-48be-831e-96e165ad537a","year":2023},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.204691Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:8a9564cd2ba7609c31980955bee3351bbd4d0e394f5a8b69b85f3177bec99b15","observation_id":"f5ba8875-fc91-4098-973f-55f9f27a509d","resolution":{"observed_at":"2026-08-15T21:46:23.349573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.327911Z","title":"Film-qnn: Efficient fpga acceleration of deep neural networks with intra-layer, mixed-precision quantization","venue":null,"work_id":"91b326e0-16ef-4030-9a3f-9aa749f0a109","year":2022},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.209081Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:796b34858e10b7edda9bbb2de46cb83c2e7258201e6aa343dae8333144f9e5cb","observation_id":"2473c3b1-39c4-4243-b2b9-d609f08395be","resolution":{"observed_at":"2026-08-15T21:46:23.332969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.312418Z","title":"Understanding the potential of fpga-based spatial acceleration for large language model inference","venue":null,"work_id":"6e57859f-742a-431c-9985-4b5df7303287","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.213840Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:95d6adbe6b9cfdaecca40b0f92e9351b63a9ae25755717403077e53107e598e9","observation_id":"3ebbecc7-6dbf-4877-ae6d-e4c0ae4d8643","resolution":{"observed_at":"2026-08-15T21:46:23.317160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:46:23.296842Z","title":null,"venue":null,"work_id":"58f26e6b-8e03-44a2-bcb3-0735e2cb652b","year":1997},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.218413Z"},"links":{"citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:fd9022c86717b2e43874cbee195537f1b02549270719a35d44322787a6b6d1a1","observation_id":"1fe1fd53-c6bd-44b1-a568-66745d185d29","resolution":{"observed_at":"2026-08-15T21:46:23.301735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2505.08981."}