{"as_of":"2026-08-08T23:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7ce29c99d2e418c0aee992ba69c90b1856795660ffd0878bcc924442960c4ec","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:53:20.715200Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.20191/citation-record","integrity":"/paper/2602.20191/integrity","json":"/paper/2602.20191/citation-record.json","paper":"/paper/2602.20191"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11431","last_updated":"2025-06-13T03:08:18Z","snapshot_observed_at":"2026-08-07T09:18:52.566169Z","submitted_at":"2025-06-13T03:08:18Z","title":"TruncQuant: Truncation-Ready Quantization for DNNs with Flexible Weight Bit Precision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11431","snapshot_observed_at":"2026-08-02T21:53:20.211127Z","title":"C., Jeon, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.211127Z"},"links":{"cited_paper":"/paper/2506.11431","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:9fb3aaa8901e5a8f6c445dc4cd917bcaad2b8df5d0092f78b724e4f72ed7a49c","observation_id":"79cde160-0886-48e4-bcac-3135eb5ff04c","resolution":{"observed_at":"2026-08-02T21:53:20.211127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:53:20.295417Z","title":"and Patterson, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.295417Z"},"links":{"citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:b77e4924c7028fd1d7bfec8a80e74699468e0822bf47288b210d9f9356200ba8","observation_id":"8d493c7c-a6a5-4df7-be60-42d327583dc7","resolution":{"observed_at":"2026-08-02T21:53:20.295417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:53:20.414752Z","title":"J., and Lee, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.414752Z"},"links":{"citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:7a63133b2a2781eaebeff6524eb62155e929bc9682307d5e93ffa9ce95829d21","observation_id":"8f5d2d71-e563-4c41-87f1-0f1877eabcef","resolution":{"observed_at":"2026-08-02T21:53:20.414752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-02T21:53:20.504754Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.504754Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:85b6fe1a77b34726e8497b4ce2589321b2caa2518c5dbf84daefce363a3b0b35","observation_id":"0ec1bf84-1639-49c3-a580-a3077dd4f018","resolution":{"observed_at":"2026-08-02T21:53:20.504754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:53:20.614769Z","title":"Overall Algorithm of MoBiQuant","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.614769Z"},"links":{"citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:227207c9e3ca7cbda696ead6eca44dbd420408a6c19227d28ee3686cb6d39ff3","observation_id":"3b04d30d-02c0-4e1c-85ff-71bbe0265205","resolution":{"observed_at":"2026-08-02T21:53:20.614769Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T21:53:20.715200Z","title":"LET preserves the main linear path by transforming the input activation and compensating the linear weights so that the layer output remains equivalent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.715200Z"},"links":{"citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:74a6c8a7fb2789d4050cd5b37f7727e957dce8eceb6107919288286295697de4","observation_id":"fad77491-c7aa-49b6-95d7-8cc9f00e1ec7","resolution":{"observed_at":"2026-08-02T21:53:20.715200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-02T21:53:19.688454Z","title":"Think you have solved question answering? try ARC, the AI2 reasoning chal- lenge.arXiv:1803.05457,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.688454Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:e565c0bb35520a9a5de5046a9fce7edc03e83b19957333b06b16536a744dd1d7","observation_id":"86a81e30-791e-4a1e-8881-bd623c7df1f5","resolution":{"observed_at":"2026-08-02T21:53:19.688454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14152","last_updated":"2025-04-19T02:51:45Z","snapshot_observed_at":"2026-08-07T16:00:59.203715Z","submitted_at":"2025-04-19T02:51:45Z","title":"FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14152","snapshot_observed_at":"2026-08-02T21:53:19.986284Z","title":"FGMP: Fine-grained mixed-precision weight and activation quantization for hardware-accelerated LLM inference.arXiv:2504.14152,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.986284Z"},"links":{"cited_paper":"/paper/2504.14152","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:03c4f54f45112d2355a5db4021b7796a2288ff818cebff57cd2f516030ddf639","observation_id":"bc863dbc-6cf7-4162-8af6-298115b03b33","resolution":{"observed_at":"2026-08-02T21:53:19.986284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-02T21:53:19.794376Z","title":"GPTQ: Accurate post-training quantization for generative pre-trained transformers.arXiv:2210.17323,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.794376Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:d09c078ab48f172f943e5848943ab1df5cf68b70a609f38bd15d05c6132b10af","observation_id":"f5730d99-596a-4f42-b972-8ba02549b4dd","resolution":{"observed_at":"2026-08-02T21:53:19.794376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05265","last_updated":"2025-01-27T13:39:25Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:59:35Z","title":"PrefixQuant: Eliminating Outliers by Prefixed Tokens for Large Language Models Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05265","snapshot_observed_at":"2026-08-02T21:53:19.546144Z","title":"PrefixQuant: Static quantization beats dynamic through prefixed outliers in LLMs.arXiv:2410.05265,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.546144Z"},"links":{"cited_paper":"/paper/2410.05265","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:00b37344e32ae80f01cfe19f3636ec222b853c27c6356c3d60db151fec9394cf","observation_id":"141b2ca0-3e07-4514-926d-badf21f465f3","resolution":{"observed_at":"2026-08-02T21:53:19.546144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-02T21:53:19.873410Z","title":"W., and Keutzer, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:19.873410Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:f23eb6606121828bb0ba2fbf2f3483beb470b7eab7622014164a87ba44d0e32e","observation_id":"25bd78b3-a95f-442e-be59-9f3ed5ccdfc2","resolution":{"observed_at":"2026-08-02T21:53:19.873410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-02T21:53:20.106717Z","title":"Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.106717Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:4741ae92fea006dbfa1f23bd7303422a5bd5b1ed24c333dc5c908c47049c341c","observation_id":"358df1f3-b77a-4a79-a336-cc2c15041569","resolution":{"observed_at":"2026-08-02T21:53:20.106717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-02T21:53:20.339214Z","title":"Pointer sentinel mixture models.arXiv preprint arXiv:1609.07843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:20.339214Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2602.20191"},"observation_digest":"sha256:7526ebb1abd176d0156f655c80dac4a1d7a146d8ad2fed39acdf9ae8e4192298","observation_id":"5668b894-29a7-45d9-a323-4b035854b1a3","resolution":{"observed_at":"2026-08-02T21:53:20.339214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.20191","last_updated":"2026-05-25T16:17:59Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T22:52:57.871575Z","submitted_at":"2026-02-21T21:11:08Z","title":"MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2602.20191."}