{"as_of":"2026-08-11T17:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:711e05e0b2629056f61868ebc5f3654dc2fa275fda406192ec7ca1f336557715","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:39:33.130911Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12956/citation-record","integrity":"/paper/2501.12956/integrity","json":"/paper/2501.12956/citation-record.json","paper":"/paper/2501.12956"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T16:39:32.975219Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:32.975219Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:dd0e7986dd94bdb699020a1c006b77684fb06fa5c2d9d97496243a730854f866","observation_id":"2c517ffd-14d7-4958-8c9b-a7514b41cea5","resolution":{"observed_at":"2026-08-10T16:39:32.975219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-10T16:39:33.020391Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.020391Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:7e69e34dc0a89b54ec8e42a60ce0ae39c34520a545eeb89e2b9395dcc4ee64b5","observation_id":"aa2789a8-956f-424c-b61b-ee1253462a75","resolution":{"observed_at":"2026-08-10T16:39:33.020391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-10T16:39:33.032799Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.032799Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:b4a3886a5c45dbb7b599c69dba7386c9cacd45248a2fba9537ff45bce6631c1a","observation_id":"ae6a6cfe-e605-47a4-8ad3-6bef7fe0b62b","resolution":{"observed_at":"2026-08-10T16:39:33.032799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.877722Z","title":"Fast matrix multiplications for lookup table-quantized llms","venue":null,"work_id":"0d50b97d-c247-4ac2-93d6-bb784862a8bc","year":2024},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.044885Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:93b86662981c8b7c465df66298542f1d74c95e5f768e75a73037332ac2c9e5a5","observation_id":"e1a5d41e-b01d-4b3e-85eb-d8f6afae6bbc","resolution":{"observed_at":"2026-08-10T16:39:33.885673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-10T16:39:33.061039Z","title":"Version 22.1","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.061039Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:08d781f71b7049bd7e9a47551e804835fa495944d4faf3313c9e8dd2b1cf49db","observation_id":"8bc6ef43-27ae-4835-8f6b-7ac349944999","resolution":{"observed_at":"2026-08-10T16:39:33.061039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.070637Z","title":"X., Nie, J.-Y ., and Wen, J.-R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.070637Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:6fb41a51f54f0fda3a14893dce544915e49ceb5645521f342ab4de8cbbb15dcc","observation_id":"2ea6260f-dbee-4083-9a4d-6e25561ee95c","resolution":{"observed_at":"2026-08-10T16:39:33.070637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.848511Z","title":"Llm-qat: Data-free quantization aware training for large language models","venue":null,"work_id":"616b96b3-0e07-453c-bb52-d06197d8f39e","year":2024},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.077198Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:55d5e831c890042e0f56272fe6188bf820f639adc3ba91635968e2c6f4c88317","observation_id":"1b6b94ea-19b0-4aca-8210-3fec4b411edd","resolution":{"observed_at":"2026-08-10T16:39:33.853814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.824366Z","title":"A., MacIntyre, R., Bies, A., Ferguson, M., Katz, K., and Schasberger, B","venue":null,"work_id":"93e95123-e680-4dac-8c3a-7d168895b14c","year":1994},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.084416Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:e1aec3393d69c28a5964f84ff79dd5f6f06197b8b5700d596422951c77194085","observation_id":"5826ddfa-8a06-47a9-9793-ec4bda5a408b","resolution":{"observed_at":"2026-08-10T16:39:33.829834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T16:39:33.097499Z","title":"Llama: Open and efficient foundation lan- guage models.arXiv preprint arXiv:2302.13971, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.097499Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:aac48c8880c1264089623cd2a04e98cb9f2f48996ed598d1861470f6dfdfa658","observation_id":"a4025208-1a45-4d00-bec7-8d4464fd1dad","resolution":{"observed_at":"2026-08-10T16:39:33.097499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02233","last_updated":"2025-02-23T14:16:52Z","snapshot_observed_at":"2026-07-06T16:14:30.917765Z","submitted_at":"2023-09-05T13:39:38Z","title":"Augmenting Black-box LLMs with Medical Textbooks for Biomedical Question Answering","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02233","snapshot_observed_at":"2026-08-10T16:39:33.103957Z","title":"Augmenting black-box llms with medical textbooks for clinical question answering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.103957Z"},"links":{"cited_paper":"/paper/2309.02233","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:bb0f264c8767e9f9e8d3b080b8454c5b1fdea6175c58a6c3e32cc4ce640234f9","observation_id":"814adf65-71dd-4d0a-b1c4-b592457988cd","resolution":{"observed_at":"2026-08-10T16:39:33.103957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-10T16:39:33.109217Z","title":"Huggingface’s transformers: State-of-the- art natural language processing.arXiv preprint arXiv:1910.03771,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.109217Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:3dbbbf4f38350283ea93d6ea9ae0a805708ab27350ef52ad59cccf653c2cfaca","observation_id":"fe1ec67c-a8aa-4c2c-99f5-bdbbcfd8c571","resolution":{"observed_at":"2026-08-10T16:39:33.109217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-10T16:39:33.121158Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.121158Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:1f26c0e1d2c0f48aa9c2a857cceb687c578feea954d5fbbf8a5efad019536af8","observation_id":"e18376b8-e0dd-4e98-8c91-0559c3b0abc2","resolution":{"observed_at":"2026-08-10T16:39:33.121158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-10T16:39:33.125674Z","title":"V ., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.125674Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:ff8a726fcd01c13e515b8ad5efa4855d010e46500a3b22ec4712fa11576278fe","observation_id":"42c6e2f1-8283-46da-8389-668bb169e234","resolution":{"observed_at":"2026-08-10T16:39:33.125674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3728.8219","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.263246Z","title":null,"venue":null,"work_id":"3a76a5a3-9c8a-489b-916b-953ed365a5ea","year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.130911Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:fc3edcd5941f4d8418c22425059c621b0f91a26f9030b1755310854594fd1b07","observation_id":"6121e131-c2a5-4321-9291-395e8aa041ae","resolution":{"observed_at":"2026-08-10T16:39:33.292416Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-10T16:39:33.026316Z","title":"Gptq: Accurate post-training quantization for generative pre- trained transformers.arXiv preprint arXiv:2210.17323,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":1925,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.026316Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:ed1136ab763ec1245be40ce2b0141dd1b1fcbfe97f0cf1dab764800864c78d74","observation_id":"4d280e49-f035-4377-9229-8007e5dd0d6a","resolution":{"observed_at":"2026-08-10T16:39:33.026316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06003","last_updated":"2025-07-28T10:09:27Z","snapshot_observed_at":"2026-08-09T20:48:29.296008Z","submitted_at":"2024-08-12T08:52:14Z","title":"LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06003","snapshot_observed_at":"2026-08-10T16:39:33.091094Z","title":"Llama-3: Meta ai’s latest language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.091094Z"},"links":{"cited_paper":"/paper/2408.06003","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:7fa5857e1090e9abbf0431e20cd19e22e3b48508f2149aa366c1550dfaf8df2c","observation_id":"e5befff7-2b77-46eb-9120-8a117f26f522","resolution":{"observed_at":"2026-08-10T16:39:33.091094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-10T16:39:33.006003Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.006003Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:42f437553f94e3bbf1e91eb387cde6437c00571c49f27e0d01272589d3809194","observation_id":"8e3cd454-0649-4207-a733-76ab915a6aa4","resolution":{"observed_at":"2026-08-10T16:39:33.006003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-10T16:39:32.993144Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:32.993144Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:7a05c6b0c503546aa51b2316516c9e61ac7f0b78c9f37b787149d74f5b13cb55","observation_id":"aa5f5249-3049-4a86-9084-2bacfb5e58a6","resolution":{"observed_at":"2026-08-10T16:39:32.993144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-08-08T23:08:43.190961Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-08-10T16:39:33.011960Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression.arXiv preprint arXiv:2306.03078,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.011960Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:ed7bd36559d432a58375f049be37a879a7ed908e61cf7e1485778462b85df641","observation_id":"7d3debeb-5733-4a17-a01c-95f6d60c1710","resolution":{"observed_at":"2026-08-10T16:39:33.011960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05600","last_updated":"2023-08-10T14:19:58Z","snapshot_observed_at":"2026-08-10T20:22:43.623708Z","submitted_at":"2023-08-10T14:19:58Z","title":"NUPES : Non-Uniform Post-Training Quantization via Power Exponent Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05600","snapshot_observed_at":"2026-08-10T16:39:33.116771Z","title":"Nupes: Non- uniform post-training quantization via power exponent search.arXiv preprint arXiv:2308.05600,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.116771Z"},"links":{"cited_paper":"/paper/2308.05600","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:0cb0cb7c94cc4c9cb42ed933217c3597d421c32c62d7ba5dfae8587fd7d40c4f","observation_id":"6a79fdb1-6923-4457-901b-1c455ce25e1e","resolution":{"observed_at":"2026-08-10T16:39:33.116771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:33.936602Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":"92f8ad54-d41c-4c10-98dd-7a55fa35e890","year":2019},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:32.986306Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:4dc81fb0f4a52b47ea3cd2cfcf12edff648022f6aac4881a99a36a1c902d6dff","observation_id":"f582e29a-cd3e-4074-bc11-45edd6b1c7bb","resolution":{"observed_at":"2026-08-10T16:39:33.944337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:32.980810Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:32.980810Z"},"links":{"citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:1044bda939b3d88de33290bfe264226f0869200657b80f5eb6991c157de5ed5a","observation_id":"e8e4dac9-0063-4553-a53f-0c832cb86a8c","resolution":{"observed_at":"2026-08-10T16:39:32.980810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-10T16:39:33.051539Z","title":"Version 12.0","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:33.051539Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2501.12956"},"observation_digest":"sha256:72f0e6380cd98363ab88078c42654cc4933c8770fc653c7056f6306fa1e172ee","observation_id":"d8f54638-188a-4ceb-a98f-3d4c61185778","resolution":{"observed_at":"2026-08-10T16:39:33.051539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.12956","last_updated":"2025-06-09T04:15:20Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T20:23:13.385674Z","submitted_at":"2025-01-22T15:29:09Z","title":"GANQ: GPU-Adaptive Non-Uniform Quantization for Large Language Models"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2501.12956."}