{"as_of":"2026-08-16T08:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d53a07fb1ddf5a356a0bc53c9ea3929d993d3d478d172475df0c231b54cf1d8f","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:18:05.706979Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:46:23.173339Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T21:46:23.280942Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"cited_work":{"arxiv_id":"2411.11745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11745","snapshot_observed_at":"2026-08-15T21:46:23.280942Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","venue":"cs.LG","work_id":"88265e88-f3d4-4b5a-8279-03819c67950c","year":2024},"citing_paper":{"arxiv_id":"2505.08981","last_updated":"2025-05-13T21:46:56Z","snapshot_observed_at":"2026-08-15T21:40:59.582995Z","submitted_at":"2025-05-13T21:46:56Z","title":"ITERA-LLM: Boosting Sub-8-Bit Large Language Model Inference via Iterative Tensor Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:46:23.173339Z"},"links":{"cited_paper":"/paper/2411.11745","citing_paper":"/paper/2505.08981"},"observation_digest":"sha256:63a06daf0a4d6e2fdc1ab0fd03db2a6fa6aa28319e0dce658935b097743b365a","observation_id":"f4ac93e7-a401-4204-8c39-840f13031454","resolution":{"observed_at":"2026-08-15T21:46:23.285813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11745/citation-record","integrity":"/paper/2411.11745/integrity","json":"/paper/2411.11745/citation-record.json","paper":"/paper/2411.11745"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.088886Z","title":"01-ai/yi-6b","venue":null,"work_id":"78af4f96-50a2-4efd-aca2-e294f87027f5","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.257355Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:eb4d335e9e5caa0d683b83eee48c8b4bb46e736ff8b7dbd669c130171f211a16","observation_id":"5980f8c2-9ac9-4b74-8e65-5e0c6bca93cd","resolution":{"observed_at":"2026-08-12T18:18:07.093803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14252531","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.741868Z","title":"BitMoD Artifacts,","venue":null,"work_id":"b0c67846-087a-4b67-8cd3-083496fa246c","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.265724Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ba2bf607fe6b61249d9aca1a8917bf4e9ff944490f988114bbab19c34c0dd986","observation_id":"f3db5b81-78fd-46ec-817c-fb981a9bd287","resolution":{"observed_at":"2026-08-12T18:18:05.748429Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.073563Z","title":"Bit-pragmatic deep neural network computing,","venue":null,"work_id":"49473a0c-7dec-4968-a8d2-cd858d18d591","year":2017},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.271979Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:bf3c820fb9d0ed8da606cb50354fc5bdf9a9eaf181771a5580956efbeef61b9c","observation_id":"85c2b403-7f55-4119-9554-9a3dc3c2039f","resolution":{"observed_at":"2026-08-12T18:18:07.078440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-13T00:40:50.161960Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-12T18:18:05.277708Z","title":"QuaRot: Outlier-free 4-bit inference in rotated llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.277708Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:29ce8271285f30dd61905062dce2ddba0d21a7de4ea9b16236f06d0a38ba5740","observation_id":"b1d1d050-6357-4e44-a76b-6576bf2429e7","resolution":{"observed_at":"2026-08-12T18:18:05.277708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.058845Z","title":"FPRaker: A process- ing element for accelerating neural network training,","venue":null,"work_id":"9a1002ef-6177-4adf-8778-2d9220023790","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.284471Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:01aff374bf084085788b31c24ada63ffdeeae4a8b86d6e02849170fcbf683ec7","observation_id":"283835d1-d567-4638-a37d-c325ce5fac9f","resolution":{"observed_at":"2026-08-12T18:18:07.063442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.042607Z","title":"CACTI 7: New tools for interconnect exploration in innovative off-chip memories,","venue":null,"work_id":"93cbfc2f-6349-4b1f-9e11-79db6e8a1b45","year":2017},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.290001Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a2f9bde6a0f6329d7d1f7021164e9c860eea8f5a6b3e46583d29e7071b7de8ea","observation_id":"1ab82118-8b93-4fd4-b0b9-4639df009127","resolution":{"observed_at":"2026-08-12T18:18:07.048207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-12T18:18:05.295419Z","title":"PIQA: Reason- ing about physical commonsense in natural language,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.295419Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2853a21db2e1de883d9d231741b4d32fb17424ede004bbbcde01b2b4be49f377","observation_id":"8247cbb4-f2c7-479e-af6c-7e86b6ba2857","resolution":{"observed_at":"2026-08-12T18:18:05.295419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.027339Z","title":"A signed binary multiplication technique,","venue":null,"work_id":"a4d83adc-0d05-46a9-8626-986e8a03c2ce","year":1951},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.301841Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:81a091f1233eec14c252cbab61800928cd6aac8234438fe976ef13095c2c346f","observation_id":"1bb55cd6-20b9-410b-85a1-fc2509bf2904","resolution":{"observed_at":"2026-08-12T18:18:07.032222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:07.011522Z","title":"Language Models are Few-Shot Learners,","venue":null,"work_id":"3fe53851-7a3b-423f-b51b-3fc2ce63f6cb","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.306784Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:7be9ad30192f498a4cb5a22498b46bfeefb648dad90c42735122c0b129bda3aa","observation_id":"e693a695-8dfa-455c-96f3-26882d34f732","resolution":{"observed_at":"2026-08-12T18:18:07.016246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13304","last_updated":"2024-01-15T21:54:28Z","snapshot_observed_at":"2026-08-13T10:48:32.813378Z","submitted_at":"2023-07-25T07:44:06Z","title":"QuIP: 2-Bit Quantization of Large Language Models With Guarantees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13304","snapshot_observed_at":"2026-08-12T18:18:05.311475Z","title":"QuIP: 2-bit quan- tization of large language models with guarantees,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.311475Z"},"links":{"cited_paper":"/paper/2307.13304","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:9fcd95796925d9d4561288272f9fafa9ceeef9c238ea0658ed8f40a1235fbcf0","observation_id":"c8357a80-ce17-4376-8e94-8a10bda052d8","resolution":{"observed_at":"2026-08-12T18:18:05.311475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11062","last_updated":"2025-05-19T06:20:01Z","snapshot_observed_at":"2026-08-13T19:22:45.524352Z","submitted_at":"2024-07-10T17:53:30Z","title":"EfficientQAT: Efficient Quantization-Aware Training for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11062","snapshot_observed_at":"2026-08-12T18:18:05.317424Z","title":"EfficientQAT: Efficient quantization-aware training for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.317424Z"},"links":{"cited_paper":"/paper/2407.11062","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:c7629123838ac5bf08024f167444aedd1d1131a8e5cb519fe01af3a613262ffb","observation_id":"479af3e7-051c-426f-9b63-c405f4b01b9a","resolution":{"observed_at":"2026-08-12T18:18:05.317424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.996063Z","title":"BBS: Bi-directional bit-level sparsity for deep learning acceleration,","venue":null,"work_id":"6a5ef273-4346-4cef-9516-4fecb767fee9","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.323687Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:05f5a52f5a0842e21092edfa5a6c3790159108c9598b515b51690498bb801038","observation_id":"2dccfd08-f436-4a41-9d2f-7da58dade405","resolution":{"observed_at":"2026-08-12T18:18:07.001260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-12T18:18:05.334165Z","title":"Think you have solved question answering? try ARC, the ai2 reasoning challenge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.334165Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:bc1acd11314786852e0c1f2b1144db1d4d2a74ef204ca567883f5e691303305f","observation_id":"cee050f3-4088-47be-b257-5ebbad780cd2","resolution":{"observed_at":"2026-08-12T18:18:05.334165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.981162Z","title":"VS-Quant: Per-vector scaled quantization for accurate low-precision neural network inference,","venue":null,"work_id":"d9edf1a6-6b5f-46c2-a744-721810ab8f3e","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.339536Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:9309c790e9f01c6d82ca8b867f110bdef14544240fa1515f81dd7dae2da1999f","observation_id":"8dd416d3-fa3a-4749-bfbb-8be9bd237287","resolution":{"observed_at":"2026-08-12T18:18:06.985768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-12T18:18:05.345398Z","title":"LLM.int8(): 8-bit matrix multiplication for transformers at scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.345398Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:26eefba84ccc6689f0da7c59b0dd4a4bf418baf5d12da36b27f9419d440a2d58","observation_id":"3ee0bdbf-5c80-4a4f-a57f-37e70919a3b5","resolution":{"observed_at":"2026-08-12T18:18:05.345398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02861","last_updated":"2022-06-20T16:05:15Z","snapshot_observed_at":"2026-08-14T11:59:04.372290Z","submitted_at":"2021-10-06T15:43:20Z","title":"8-bit Optimizers via Block-wise Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02861","snapshot_observed_at":"2026-08-12T18:18:05.352436Z","title":"8-bit optimizers via block-wise quantization,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.352436Z"},"links":{"cited_paper":"/paper/2110.02861","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:2f47bdb586d789b6c34dbbd2bb19a9450f1ffde16d595dfb02873929ebb03cf4","observation_id":"5d175240-32ff-4a1c-b08a-03049c74372f","resolution":{"observed_at":"2026-08-12T18:18:05.352436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-08-13T23:56:42.354755Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-12T18:18:05.360468Z","title":"QLoRA: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.360468Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8e6d368377809170640787f877322db951318a64bd9643224ff2ff429ba9653d","observation_id":"d5de9375-3bab-4329-9031-273fd6e52c1e","resolution":{"observed_at":"2026-08-12T18:18:05.360468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.966135Z","title":"Documenting large webtext corpora: A case study on the colossal clean crawled corpus,","venue":null,"work_id":"590c4b8c-5edf-47a2-a925-37f6157df706","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.369228Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:6a22b8b46687d2ef430ce60b77c4474ec36a1855f115a2a29f5e7831e4404e87","observation_id":"8db960d5-1417-4ef1-adb4-636f12b28563","resolution":{"observed_at":"2026-08-12T18:18:06.971045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03103","last_updated":"2024-06-10T23:41:18Z","snapshot_observed_at":"2026-08-13T00:14:23.764764Z","submitted_at":"2024-05-06T01:39:59Z","title":"Learning from Students: Applying t-Distributions to Explore Accurate and Efficient Formats for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03103","snapshot_observed_at":"2026-08-12T18:18:05.378635Z","title":"Learning from students: Applying t-distributions to explore accurate and efficient formats for llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.378635Z"},"links":{"cited_paper":"/paper/2405.03103","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:fd078043bcae73402a4fcb00007379a4ef0110058aca89fdb731be0e2e59d3b6","observation_id":"b6cda7ca-1185-4e43-876d-878d71f5eb86","resolution":{"observed_at":"2026-08-12T18:18:05.378635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-16T07:57:19.216626Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-12T18:18:05.384374Z","title":"GPTQ: Accurate post-training compression for generative pretrained transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.384374Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:14402e2cd76ccf779d77713e86521e1ba66e3572f38303b9835f991c389aba61","observation_id":"3545e30f-95d4-4a26-bbc4-f21d6b72dc04","resolution":{"observed_at":"2026-08-12T18:18:05.384374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.950867Z","title":"A framework for few-shot language model evaluation,","venue":null,"work_id":"d8f28772-4d1c-42cb-ab19-48809cb1f2e5","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.390678Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:35914ca9b45f131bf9d2e0647a6c206f13aef25c05dcfc4ea006576a203b1bf9","observation_id":"ddfe7364-2d0d-436f-ab60-51c3a907f32d","resolution":{"observed_at":"2026-08-12T18:18:06.955989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.403258Z","title":"Ai and memory wall,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.403258Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3ee90d0496c233c939d4e1a5c4ffbbff71bb981f778c89399774544798fda200","observation_id":"be480d8e-aee2-44cd-b3a2-f461bf46836d","resolution":{"observed_at":"2026-08-12T18:18:05.403258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.924359Z","title":"SparTen: A sparse tensor accelerator for convolutional neural net- works,","venue":null,"work_id":"e0baa752-853a-4992-9e7c-69efc8b416b8","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.409046Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4116d503599b3d0484e0cc18ee6a3c4b20521828283388b3ae6e27a1e3d73f78","observation_id":"f0a69e1c-d141-402f-b7f2-99c277903d3e","resolution":{"observed_at":"2026-08-12T18:18:06.929217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.909209Z","title":"Eureka: Efficient tensor cores for one-sided unstructured sparsity in dnn inference,","venue":null,"work_id":"d79d9a2a-f802-4ed9-8c0d-771c0a2fed2b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.413936Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:fd8ea4a9256fdee8790ad92c17d2e29ca364cbeac3ff3bf93979a84b3f0c9366","observation_id":"0d38f1b3-3691-420e-aee0-19b0f326cda5","resolution":{"observed_at":"2026-08-12T18:18:06.914369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.894562Z","title":"OliVe: Accelerating large language models via hardware-friendly outlier-victim pair quantization,","venue":null,"work_id":"aa52a606-de51-4f14-97d6-8f9ae44a326b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.420014Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:25d7406683be2c7c627c99a4eca720f9ed795ded8532aae6b8e4fccc8c38700d","observation_id":"e73d0ec0-f500-4865-9674-ce9d76d013be","resolution":{"observed_at":"2026-08-12T18:18:06.899467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.876984Z","title":"ANT: Exploiting adaptive numerical data type for low-bit deep neural network quantization,","venue":null,"work_id":"f285dd87-0dcb-4dab-acc4-ea5850f86920","year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.426405Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3f6c9688ff3e59e5e142deeec998853ca5c3d363a15bbf402fe1ab61843d327d","observation_id":"f5e1e0db-32d5-40fd-b2f0-64bbb5dd0d49","resolution":{"observed_at":"2026-08-12T18:18:06.883982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.433723Z","title":"FIGNA: Integer unit-based accelerator design for fp-int gemm preserving numerical accuracy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.433723Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:cc9944439a447a93f88376fa066cc5d26834a43b713d5bcfe5293ef3262dbb38","observation_id":"ee59c750-11f7-459f-9815-ebfb865b8435","resolution":{"observed_at":"2026-08-12T18:18:05.433723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.851459Z","title":"Stripes: Bit-serial deep neural network computing,","venue":null,"work_id":"5c525455-9ba0-4b86-8cdc-a0db6cf01fd9","year":2016},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.440602Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:38fd265972ca1714ba633992baf501a35c5a95e507b2bcca443703b024ce48a4","observation_id":"2a54e312-1d68-430f-975c-db83cf9d2b67","resolution":{"observed_at":"2026-08-12T18:18:06.857184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.836164Z","title":"DRAMsim3: A cycle-accurate, thermal-capable dram simulator,","venue":null,"work_id":"3ae991e9-687f-4e87-9ac1-39d8414d5051","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.447222Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:159b04c5ac89584207bc1d55ae103e72507de0dcf227f1ebce3fa079d5ff20fa","observation_id":"c003ceb1-e834-4fa9-a93f-2963c7bb798f","resolution":{"observed_at":"2026-08-12T18:18:06.841526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.821752Z","title":"AWQ: Activation-aware weight quanti- zation for llm compression and acceleration,","venue":null,"work_id":"0d8f7828-cbb4-4048-8ba6-037f80354967","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.452627Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5e0c6a204e9ec1488817fcbb6351cac0d625144a6d9487192d1dcf81d398d605","observation_id":"c7bfffa2-5e67-44db-af87-c87d603e6992","resolution":{"observed_at":"2026-08-12T18:18:06.826244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-13T11:30:33.812255Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-12T18:18:05.459059Z","title":"LLM-QAT: Data-free quan- tization aware training for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.459059Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a8387970c8f0a1018a9d5d7c40266cc9206f16208ebee05367915c5df091b2fe","observation_id":"d62349f3-65fb-469f-a062-cce71e198d54","resolution":{"observed_at":"2026-08-12T18:18:05.459059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.807616Z","title":"Torch2Chip: An end-to-end customizable deep neural network compression and deployment toolkit for prototype hardware accelerator design,","venue":null,"work_id":"66f22718-22a4-4b7b-9618-debe8470588d","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.464500Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:42d354ff7c8319ecbfb2918ae6d6f1dd44cb6479ee9776b00b4ea8fe588f6556","observation_id":"f5a1814d-ea1c-46dd-a8c9-d88538f1ba26","resolution":{"observed_at":"2026-08-12T18:18:06.812130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-12T18:18:05.469720Z","title":"Pointer sentinel mixture models,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.469720Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ebadca68d5bf9c61224ee3ab4c51338d9ce1e3fa3c3082b81e1b262035a29ec0","observation_id":"5b3eedc9-d35b-4eb3-b600-5fc5a3d69f79","resolution":{"observed_at":"2026-08-12T18:18:05.469720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.793460Z","title":"Meta llama","venue":null,"work_id":"7ae4cb09-8d3d-4b1b-80b8-130debd04110","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.475392Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:4749387075f3372fa384a0b897904de73cd3a7683e2011b3fb9dc2fa2a8e4dda","observation_id":"81d9296d-5f45-4c8d-863f-3f33405fbfd7","resolution":{"observed_at":"2026-08-12T18:18:06.797973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.777579Z","title":"Meta llama 3","venue":null,"work_id":"3062e7a6-b89d-4b64-98d8-cd9d133f81a1","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.480490Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f12df9a1ec804f16f074fa130502eb28d0dff1137efbdd40851b4945bce244e3","observation_id":"16847e1a-113b-4511-9d86-e791d99069ae","resolution":{"observed_at":"2026-08-12T18:18:06.782651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.761950Z","title":"microsoft/phi-2","venue":null,"work_id":"bbfec49f-b7f4-4b57-b85c-0db288b27f39","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.486820Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:828c6eb18adaaeeb5c4091a08d8b7fbf077faed2b5bb4dc55fe45ab92e7fc5cd","observation_id":"403f10ea-6298-4d20-b183-be7cc6748a9a","resolution":{"observed_at":"2026-08-12T18:18:06.767329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.746249Z","title":"Jetson TX2 Module","venue":null,"work_id":"55268afd-1a9b-471a-b423-6328a6acf115","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.492944Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:024bfae49784d655c2df765c9f8937e367a2a4f8a65c6c159bc900ffc1ca1f24","observation_id":"b725fec7-f52c-423a-8b77-a3f1e5b557ea","resolution":{"observed_at":"2026-08-12T18:18:06.752027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.731073Z","title":"OCP Microscaling Formats (MX) Specification","venue":null,"work_id":"637b6bee-f0cd-4a1f-b88e-c50f7c567753","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.498944Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:34acc27e71d60c718f85d9a7b9f0798aaa89156474f5a63ba32208f66188ce4a","observation_id":"c80b6c48-46be-4ec0-a7e5-2730e6c31b47","resolution":{"observed_at":"2026-08-12T18:18:06.736192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.716373Z","title":"Energy-efficient neural network accel- erator based on outlier-aware low-precision computation,","venue":null,"work_id":"f6a8d561-3b1e-46e7-b2cb-a8020bf294cb","year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.503531Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:26be8b8cdcb4b8072ad614550dddf12ec4eb97a673b656a4870ec8b61c957c76","observation_id":"c30a3d7d-d8fc-43e4-9b0b-ef928c26f6e8","resolution":{"observed_at":"2026-08-12T18:18:06.721280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.701690Z","title":"With shared microexponents, a little shifting goes a long way,","venue":null,"work_id":"8e34f54c-c179-4428-a8d0-5e14b90d284b","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.508386Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:738c7f52ea20aa2f99de47c20db131c024c2ebde4d564fd6c60a832046fb40b3","observation_id":"517ccf45-9858-4d36-b639-26515244142c","resolution":{"observed_at":"2026-08-12T18:18:06.706445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.10641","last_updated":"2019-11-21T19:01:32Z","snapshot_observed_at":"2026-08-14T04:48:01.875703Z","submitted_at":"2019-07-24T18:11:59Z","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.10641","snapshot_observed_at":"2026-08-12T18:18:05.513379Z","title":"WinoGrande: An adversarial winograd schema challenge at scale,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.513379Z"},"links":{"cited_paper":"/paper/1907.10641","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a41ae623fde1cdccac24fffda78dca9fd3568518fc0feea3a8f2b7e2e0d8914b","observation_id":"2e0409e3-f551-44da-b734-00bd9a9c074b","resolution":{"observed_at":"2026-08-12T18:18:05.513379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13137","last_updated":"2024-03-18T05:33:22Z","snapshot_observed_at":"2026-08-15T10:44:06.141247Z","submitted_at":"2023-08-25T02:28:35Z","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13137","snapshot_observed_at":"2026-08-12T18:18:05.519077Z","title":"OmniQuant: Omnidirectionally calibrated quan- tization for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.519077Z"},"links":{"cited_paper":"/paper/2308.13137","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:07605212ccffcb2233b7448bfb4fa2cca777cf984c291fb11571bc9d5f224a07","observation_id":"a457cf58-7723-45a9-9ada-8dc7e4b8e1bc","resolution":{"observed_at":"2026-08-12T18:18:05.519077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.685568Z","title":"Laconic deep learning inference acceleration,","venue":null,"work_id":"1371798e-bf5b-43ae-8391-6cd9a4e12d80","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.524007Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:c01d73bf251088a30d0eab59c6618e9c73d1363eb9f2650f96f74f2c083018af","observation_id":"8a532866-447d-4e22-a875-5c451cf1c976","resolution":{"observed_at":"2026-08-12T18:18:06.691090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.669121Z","title":"FlexGen: High-throughput generative inference of large language models with a single gpu,","venue":null,"work_id":"fd32da9d-d504-491f-b770-0eefb1d14097","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.529127Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8296a94936e860a114e8f25197431576b14a6b9a0da656b36789886e99e778cb","observation_id":"75846753-f325-412f-be10-30a2118b1a66","resolution":{"observed_at":"2026-08-12T18:18:06.675090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.653734Z","title":"BitWave: Exploiting column-based bit-level sparsity for deep learning accelera- tion,","venue":null,"work_id":"ece030e3-4cd5-46d6-9a42-c77e8faa5054","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.534987Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:87dba935881e6e0ce2b2c981d6b02954a061c808fe255e996e6a94cdc471a525","observation_id":"ced9e45b-9af1-4385-b3fd-e58832ef088a","resolution":{"observed_at":"2026-08-12T18:18:06.658690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.636448Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank,","venue":null,"work_id":"9fc69d6b-0361-4ba8-b9d7-88bae7550ff6","year":2013},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.539784Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:40d6f002433d33adfd9d0fa217dfaaad4cd790d9e7d4d5c78479a560eb8651cc","observation_id":"c2cd6ec7-6458-40c1-a668-fbba858da6da","resolution":{"observed_at":"2026-08-12T18:18:06.642088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T18:18:05.544497Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.544497Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:aff649ca61de38d01a721171219f16c32c7b320fb6198f370f9ee495d370fd3a","observation_id":"5745f5c3-a3f5-44d5-869b-5d1251baba60","resolution":{"observed_at":"2026-08-12T18:18:05.544497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.620583Z","title":"Dual-side sparse tensor core,","venue":null,"work_id":"fba38cd0-1a26-4471-9633-48547c525b20","year":2021},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.549285Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:80f1120cf64f68c9378bd8058ef364ffe28ada9eb54d00b8f4fb10757bdd963a","observation_id":"ded4225a-9a55-406d-a7e9-75474353d037","resolution":{"observed_at":"2026-08-12T18:18:06.625619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08583","last_updated":"2023-12-18T05:08:23Z","snapshot_observed_at":"2026-08-13T05:02:51.919776Z","submitted_at":"2023-12-14T01:06:37Z","title":"ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08583","snapshot_observed_at":"2026-08-12T18:18:05.554103Z","title":"ZeroQuant(4+2): Redefining llms quantization with a new fp6-centric strategy for diverse generative tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.554103Z"},"links":{"cited_paper":"/paper/2312.08583","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f9eb67c4b8d24e8e7cfac70e238be75e2a5ab0be32857601e834d116cbe081cb","observation_id":"ba4a69c7-6dba-4c8d-8c65-c2e4ab1dcced","resolution":{"observed_at":"2026-08-12T18:18:05.554103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.603622Z","title":"HighLight: Efficient and flexible dnn acceleration with hierar- chical structured sparsity,","venue":null,"work_id":"832b4a6d-395c-476b-b181-7f69b8fc3f7d","year":2023},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.559461Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:691f0910d74197d7a449ff9d3b01192d6b046031ce1c12b66518cb09df82abc7","observation_id":"6794c968-4311-451b-82f0-869deebffd6e","resolution":{"observed_at":"2026-08-12T18:18:06.609183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.587424Z","title":"Quant-llm: Accelerating the serving of large language models via fp6- centric algorithm-system co-design on modern gpus,","venue":null,"work_id":"f541d23e-7fa8-4c38-b160-776e9c420947","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.564896Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:088cd6d9753e1d7b4b06f6b6ffd4832caa3741ea2cc85dbf62af22916d3d2034","observation_id":"81bf2abb-2e50-4d24-94fe-15fb05766beb","resolution":{"observed_at":"2026-08-12T18:18:06.592575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10438","last_updated":"2024-03-29T19:21:58Z","snapshot_observed_at":"2026-08-15T13:13:36.205705Z","submitted_at":"2022-11-18T18:59:33Z","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10438","snapshot_observed_at":"2026-08-12T18:18:05.569895Z","title":"SmoothQuant: Accurate and efficient post-training quantization for large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.569895Z"},"links":{"cited_paper":"/paper/2211.10438","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:7d0bc972fcc211c0b2833fe030950df55ec7de1a0e282a1f63754364285b658f","observation_id":"e1de944c-da81-4f81-af23-5ee1f9ed88ae","resolution":{"observed_at":"2026-08-12T18:18:05.569895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01861","last_updated":"2022-06-04T00:28:21Z","snapshot_observed_at":"2026-08-14T22:20:42.170453Z","submitted_at":"2022-06-04T00:28:21Z","title":"ZeroQuant: Efficient and Affordable Post-Training Quantization for Large-Scale Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01861","snapshot_observed_at":"2026-08-12T18:18:05.575588Z","title":"ZeroQuant: Efficient and affordable post-training quantization for large- scale transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.575588Z"},"links":{"cited_paper":"/paper/2206.01861","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:e81fbdc0bb0b93a9f5fbfcca92c1389ef6f2777581c6494dfed4bf30cf7331a4","observation_id":"405b02e5-3090-4efd-b4dc-2c5bd61b737b","resolution":{"observed_at":"2026-08-12T18:18:05.575588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.571600Z","title":"GOBO: Quantizing attention-based nlp models for low latency and energy efficient inference,","venue":null,"work_id":"9c7af972-1fb7-40be-b62c-e5322a39945f","year":2020},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.581299Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:77c6fd4b518810c06c5653dddf10b896b202cd3383bdd829a741d5e3a1ed2f5a","observation_id":"606dc756-95a5-425d-9d03-5d5496ea83f8","resolution":{"observed_at":"2026-08-12T18:18:06.576515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.554720Z","title":"Mokey: enabling narrow fixed-point inference for out-of-the-box floating-point transformer models,","venue":null,"work_id":"2abf583a-cba7-41ce-9e0e-30d639f188c9","year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.585855Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:026ec3c562fc5382df36190aba269ecaab31208f8962b30bfb6392a5c1a52015","observation_id":"5148d089-888a-4569-a368-292371c62538","resolution":{"observed_at":"2026-08-12T18:18:06.560040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.539779Z","title":"HellaSwag: Can a machine really finish your sentence?","venue":null,"work_id":"25890435-78b4-4fdd-8acd-972008080955","year":2019},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.591745Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:d4414b480cea0d52dcf6a55dc956c2e9a0da1fd748286fcbd804f6423b74cb11","observation_id":"a8477de0-8536-4c58-b2bc-256281b524e6","resolution":{"observed_at":"2026-08-12T18:18:06.544396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-12T18:18:05.596760Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.596760Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:02529bc3b7d58ff94bd8070b458315b4183b828ac90c6bf81e9e3d588c08e24e","observation_id":"6d2025b9-d479-43f7-a13b-0019896050f4","resolution":{"observed_at":"2026-08-12T18:18:05.596760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.524434Z","title":"Atom: Low-bit quantization for efficient and accurate llm serving,","venue":null,"work_id":"06b70d18-a202-4f8d-bc6e-b10ac03ef098","year":2024},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.602575Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:3dd8e74ab8a9498d2fd62b67d674937d85df0a692f9313bb665ffc756b988e34","observation_id":"7071b34d-afad-42e3-8527-b25bc1cc1da9","resolution":{"observed_at":"2026-08-12T18:18:06.529242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.607280Z","title":"Cambricon-S: Addressing irregularity in sparse neural networks through a cooperative software/hardware approach,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.607280Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:8304ebc6ec582497abf5b52d8647dec76497784426f0df1a7b831db8b9147489","observation_id":"3303371c-20b0-4fce-abae-616bb3a6d52b","resolution":{"observed_at":"2026-08-12T18:18:05.607280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.499361Z","title":null,"venue":null,"work_id":"3ed849fe-6823-4452-882b-ec40fd9dea83","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.612063Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:b9e7732b0dad9a8e1e24e09eefe0bb333cd5575cdbfb8b006e3e230536daa9f6","observation_id":"36f6281a-0d00-4f7d-901a-4a42eb74069e","resolution":{"observed_at":"2026-08-12T18:18:06.503921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.483036Z","title":null,"venue":null,"work_id":"2144be9a-6bdb-4220-ac68-c705ecd0dfc8","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.616663Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:437ae5675eb5de44cb8a269df2f89b354a079ba16a26d18ba008d6f84b1aa582","observation_id":"78bb736f-fabf-47bd-b937-bd5f66bcb390","resolution":{"observed_at":"2026-08-12T18:18:06.489162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1425253","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.838521Z","title":"The quantization experiments require CUDA","venue":null,"work_id":"8c9119d2-1a92-495a-b002-efc3b8d533ec","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.621575Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:0a11323a326247fe31c70927372780ccb99566d3a993183efa959751ca41d8b3","observation_id":"b7bc8668-c63e-4388-8e12-71a83e1db210","resolution":{"observed_at":"2026-08-12T18:18:05.847885Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.466653Z","title":"This can reproduce the results in Table VI and Table VIII","venue":null,"work_id":"6816721b-a7d8-4b65-8aa4-2f2952c59741","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.627026Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:a7e012492d8c99bbd32e79d546afdd5d7cf3e3815b22462c29f4dc9fe28701e6","observation_id":"7ef2cb9f-aa8c-4bd1-9b74-f3a7bf0e05f9","resolution":{"observed_at":"2026-08-12T18:18:06.472199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.450397Z","title":"This can reproduce the results in Fig","venue":null,"work_id":"caec9589-52d7-413b-9047-f606bde04fce","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.632438Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:86f5f54244cc597def121fe9f1a66ef3bd326eceafee8f123387a8af5236bcac","observation_id":"4fda59cd-4fda-4ed0-83ef-5322340e1d73","resolution":{"observed_at":"2026-08-12T18:18:06.455376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.433825Z","title":"This can reproduce the AWQ results in Table XI","venue":null,"work_id":"8e5a1872-c5d8-4f19-beae-99a14b178440","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.638201Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5a24fb4493afcab1540549017335fb5e0facb84704a48edf506318b0782338c4","observation_id":"ccab6954-7b06-4598-a270-b80f437b9928","resolution":{"observed_at":"2026-08-12T18:18:06.439448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.418950Z","title":"This can reproduce the OmniQuant results in Table XI","venue":null,"work_id":"0554ae4c-a1db-454c-948d-c2c9e794bb42","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.643669Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f5e4afa9b79d538aad218c999062267e03703af3ae7327971ae39c067148bf7e","observation_id":"04b6b87e-c3f0-4157-a89b-5fbe856fd78c","resolution":{"observed_at":"2026-08-12T18:18:06.423721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.403815Z","title":"This can reproduce the results in Table XII","venue":null,"work_id":"43c37ca8-0000-4443-ac17-c2540b9a487b","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.650161Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:fc045a4b04c1a2e5dddbdfa3b8e2aef95fc7d0822c7d1c136c5c02422c89f60b","observation_id":"c92366f4-f3f2-4e23-92e4-787655a12532","resolution":{"observed_at":"2026-08-12T18:18:06.408812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.387731Z","title":"$ cd bitmod quant $ conda activate awq−bitmod In ‘ run_exp.sh’, modify the ‘ export’ command by specifying the HuggingFace home directory, ‘ HF_HOME’, on your computer","venue":null,"work_id":"bb505671-48c4-4814-815e-02d046e540bc","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.655713Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:e81f701f92393de39d793a5b76f9e5b4cd0d10d42160f8a7b1feda3a2dcfc567","observation_id":"4507a61e-6769-434b-bce8-d90d75325cd4","resolution":{"observed_at":"2026-08-12T18:18:06.392812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.372804Z","title":"When enabled / disabled, it will evaluate the hardware performance of generative / discriminative tasks","venue":null,"work_id":"40fa30a9-2325-40fd-bc8b-9224c955b2ea","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.661738Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:6b90dfcaaca72ec0fd1432fa8352f8c7fce317c49286869514de13a92814c1c9","observation_id":"b335f717-f077-4227-9607-3bc27e81bae1","resolution":{"observed_at":"2026-08-12T18:18:06.377663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.357980Z","title":"You can compare these with the AWQ results in Table XI","venue":null,"work_id":"2e694fae-6870-4d74-805a-6bd9012bb83c","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.666231Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:6854ca50e47107953bdf0324a6612b03bc528ffe2bf30ed62d2b668e548f803e","observation_id":"6a3efef1-2698-4d18-842d-329571d40167","resolution":{"observed_at":"2026-08-12T18:18:06.362976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.342745Z","title":null,"venue":null,"work_id":"600d676b-69e1-4034-a5d9-460fd63372ad","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.672332Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:b792cbc1a7099851976fa445cda07c5d573f8ace552722d97d7546a1eb0f4397","observation_id":"4a30bf33-4317-4d58-adb4-51ffd951a815","resolution":{"observed_at":"2026-08-12T18:18:06.347977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.326017Z","title":"You can compare these results with the SmoothQuant results in Table XII","venue":null,"work_id":"28025997-fa99-436e-bb3a-7d0de34e8276","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.679560Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:35722f648b0080ceddac06970a340dd8bcc8fb08f193d034891562ed1dc28ddf","observation_id":"607bbf41-894b-4510-b912-b78731f0a07c","resolution":{"observed_at":"2026-08-12T18:18:06.331716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.308736Z","title":null,"venue":null,"work_id":"280aec4c-3b34-4f22-9a55-ad538df17cf2","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.684331Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:ac42aee257003e44fd909143293ee22bdcb4850a1f79fa0f92d1a72ae2e4a106","observation_id":"28788e20-1a97-4a3f-8bcd-8009204c5ae3","resolution":{"observed_at":"2026-08-12T18:18:06.314620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.291676Z","title":"7 and Fig","venue":null,"work_id":"6e37533a-73df-4281-add0-5008c5d4bbaf","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.689471Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:92521361a2af4eda157d7eaec6a4872a7420a0ac197ac67fa9d8e35d46633c67","observation_id":"38334d65-423d-4216-acd0-2b1ac721a5f5","resolution":{"observed_at":"2026-08-12T18:18:06.297037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.276186Z","title":null,"venue":null,"work_id":"8a5bdec4-6d49-42f2-a290-af38407053c7","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.695924Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f08d2eec8a17c43c469f0cbd77f01a14cfcf083f7c734c8433d8a271d34e0c9a","observation_id":"8da12c5d-9ead-487d-a3d2-5fd3b0df19fa","resolution":{"observed_at":"2026-08-12T18:18:06.280993Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.260454Z","title":null,"venue":null,"work_id":"337afd62-144a-4f3f-8936-80dfc7e6bc21","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.701068Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:f2829b4c75b9af1df1099b0c5fc05eaaad7b817464d4e23752188497fbcaa4a8","observation_id":"97cd8206-4895-4bee-9b4d-ff9670629902","resolution":{"observed_at":"2026-08-12T18:18:06.265003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:06.244721Z","title":null,"venue":null,"work_id":"e49b2c29-f9d9-4de1-9270-3d9c27ee2fdb","year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.706979Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:11a4bed56a67e2fe49315db9fabe393563ce646a350eebece84367aaeaf0caf8","observation_id":"9b868ba6-42a4-4fa5-91b8-220b93c04e97","resolution":{"observed_at":"2026-08-12T18:18:06.250285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:18:05.398440Z","title":"Available: https://zenodo.org/records/10256836","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T18:18:05.398440Z"},"links":{"citing_paper":"/paper/2411.11745"},"observation_digest":"sha256:5fd564d8bf7a707065442e90528ca116c1fede71abbe14bc888aff3b33ade10d","observation_id":"44b1c974-e20b-4d19-8cc4-f47a8ac52edb","resolution":{"observed_at":"2026-08-12T18:18:05.398440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.11745","last_updated":"2025-04-26T02:56:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T09:07:28.547861Z","submitted_at":"2024-11-18T17:16:58Z","title":"BitMoD: Bit-serial Mixture-of-Datatype LLM Acceleration"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":46},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 1 inbound Pith citation observation for arXiv:2411.11745."}