{"as_of":"2026-08-08T04:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98d3544a2f43223352c222da31d7adacb222f6735ed25cf51375df3416673a3f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:39.231092Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"reference_index":214,"source":"pdf_text","source_observed_at":"2026-05-15T02:39:33.007894Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2404.14294"},"observation_digest":"sha256:3b33a83bc6bb6d38f17ad7185781fb9b12b29f641f3d05d7c35abcdb5e343c5f","observation_id":"a641a9ca-a70c-44e2-9388-49afc993aa36","resolution":{"observed_at":"2026-05-15T02:39:33.265457Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2409.00084","last_updated":"2024-09-04T08:22:28Z","snapshot_observed_at":"2026-08-02T15:53:32.867922Z","submitted_at":"2024-08-25T14:50:47Z","title":"Vision-Language and Large Language Model Performance in Gastroenterology: GPT, Claude, Llama, Phi, Mistral, Gemma, and Quantized Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T22:15:52.638622Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2409.00084"},"observation_digest":"sha256:c7e1f2a698db340d33b50f47f76a05978513646a1291c445f6568c61fe4ead8f","observation_id":"862a78e2-e4d7-445d-a3fd-fd1aec2ef33e","resolution":{"observed_at":"2026-05-23T22:18:31.866486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2411.10656","last_updated":"2026-04-03T16:24:12Z","snapshot_observed_at":"2026-07-06T19:51:14.080262Z","submitted_at":"2024-11-16T01:31:29Z","title":"Precision or Peril: A PoC of Python Code Quality from Quantized Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T17:30:54.204300Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2411.10656"},"observation_digest":"sha256:4e63821a8b07572bf2ce92b2850de5c05bd24d75080c2fd2617f42946aec2650","observation_id":"b6586653-72ae-4257-81b4-6bf90a70891a","resolution":{"observed_at":"2026-05-23T17:33:15.804739Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2504.12334","last_updated":"2026-05-10T17:20:39Z","snapshot_observed_at":"2026-07-30T01:17:05.243178Z","submitted_at":"2025-04-13T12:32:25Z","title":"QM-ToT: A Medical Tree of Thoughts Reasoning Framework for Quantized Model","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T19:44:16.630377Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2504.12334"},"observation_digest":"sha256:9ea905f6b78531741b867a5980e2e26d78ca78c80c56079111c48fa0df03705b","observation_id":"49c2c6c4-0842-4523-82b2-4b6c13b7baf4","resolution":{"observed_at":"2026-05-22T19:45:03.999245Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-07T13:30:39.231092Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21670","last_updated":"2025-05-27T18:48:40Z","snapshot_observed_at":"2026-08-07T23:42:58.100393Z","submitted_at":"2025-05-27T18:48:40Z","title":"Rethinking the Outlier Distribution in Large Language Models: An In-depth Study","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:39.231092Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2505.21670"},"observation_digest":"sha256:10d9e6f449a860947ec834fe41b13fb786271c5bb5032706d070c6eedbb0d15b","observation_id":"791978d9-f2a4-4084-8f0a-e4bacc79b3eb","resolution":{"observed_at":"2026-08-07T13:30:39.231092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-07T11:27:14.258704Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02561","last_updated":"2025-06-03T07:47:30Z","snapshot_observed_at":"2026-08-08T01:27:01.613503Z","submitted_at":"2025-06-03T07:47:30Z","title":"Pruning General Large Language Models into Customized Expert Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:14.258704Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2506.02561"},"observation_digest":"sha256:e887241a41b943235aaa8c591ea63d837ab933d38fff4dec51f6710e618788f1","observation_id":"28dadb7d-edbc-4464-bdb0-e51cb846929c","resolution":{"observed_at":"2026-08-07T11:27:14.258704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-07T05:04:02.889275Z","title":"Wenqi Shao, Mengzhao Chen, Zhaoyang Zhang, Peng Xu, Lirui Zhao, Zhiqian Li, Kaipeng Zhang, Peng Gao, Yu Qiao, and Ping Luo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09104","last_updated":"2025-06-10T16:26:32Z","snapshot_observed_at":"2026-08-07T04:55:51.014007Z","submitted_at":"2025-06-10T16:26:32Z","title":"Unifying Block-wise PTQ and Distillation-based QAT for Progressive Quantization toward 2-bit Instruction-Tuned LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:04:02.889275Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2506.09104"},"observation_digest":"sha256:3ce2e563e5cec8bf180c3df61f6218de4102cb6cff347a47e541780a6509cfd2","observation_id":"8c4cb3a6-46e1-4183-bac2-86cdaabd1031","resolution":{"observed_at":"2026-08-07T05:04:02.889275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-06T18:33:17.787323Z","title":"Evaluating Quantized Large Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07877","last_updated":"2025-08-01T20:13:43Z","snapshot_observed_at":"2026-08-07T19:11:17.494477Z","submitted_at":"2025-07-10T16:00:27Z","title":"Edge-ASR: Towards Low-Bit Quantization of Automatic Speech Recognition Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:17.787323Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2507.07877"},"observation_digest":"sha256:4bd2ea61b0564763d77659ead24251ac4182b18cceb328ce0fc32d64b850d739","observation_id":"1cede3b5-eac3-48a3-bf2d-db4b57c70020","resolution":{"observed_at":"2026-08-06T18:33:17.787323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T10:38:33.171501Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04534","last_updated":"2025-09-04T04:18:45Z","snapshot_observed_at":"2026-08-06T05:31:52.923420Z","submitted_at":"2025-09-04T04:18:45Z","title":"Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:38:33.171501Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2509.04534"},"observation_digest":"sha256:8d17517d77793d58c70caaf6fd7f7288759337ad286a721bff285bd3eb865394","observation_id":"5321d1b0-82b7-4fe2-b846-3797573e3090","resolution":{"observed_at":"2026-08-05T10:38:33.171501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2604.19342","last_updated":"2026-04-21T11:25:22Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:25:22Z","title":"Are Large Language Models Economically Viable for Industry Deployment?","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-10T02:28:12.686424Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2604.19342"},"observation_digest":"sha256:9e7409f406ca823b8ac29101aed3a7d54d8b096f28b1adb6ae27fe255c49fc2a","observation_id":"994bf317-485b-406e-9b17-b7dc8e9239e8","resolution":{"observed_at":"2026-05-11T13:01:18.858666Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2604.19884","last_updated":"2026-04-21T18:03:38Z","snapshot_observed_at":"2026-08-02T02:23:56.450641Z","submitted_at":"2026-04-21T18:03:38Z","title":"From Signal Degradation to Computation Collapse: Uncovering the Two Failure Modes of LLM Quantization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T02:32:50.182859Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2604.19884"},"observation_digest":"sha256:51fba92041494f47f10f930c5f5858a22be3da56a25694027a38a13a8a961e95","observation_id":"be665ed4-b785-4c91-aa89-6a310314efce","resolution":{"observed_at":"2026-05-10T02:38:17.211730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":"2402.18158","doi":"10.48550/arxiv.2402.18158","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Li et al","venue":"arXiv (Cornell University)","work_id":"cb1d91f9-22a9-4e18-86b7-323c392a6efd","year":2024},"citing_paper":{"arxiv_id":"2606.03002","last_updated":"2026-06-04T19:39:22Z","snapshot_observed_at":"2026-08-04T10:42:06.850785Z","submitted_at":"2026-06-02T01:17:05Z","title":"Perplexity Can Miss SAE Feature Damage Under Quantization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T11:41:18.460538Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2606.03002"},"observation_digest":"sha256:1ebd420de96e5380b3becc1a3f24ac7007b414ae2d26e36d5f8d9985f506b949","observation_id":"9c61f32c-77f3-4168-b6dd-c6aabcdfd732","resolution":{"observed_at":"2026-07-02T01:36:25.768691Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-07-14T01:09:27.619062Z","title":"Evaluating Quantized Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09999","last_updated":"2026-07-23T13:41:45Z","snapshot_observed_at":"2026-08-02T07:32:08.426717Z","submitted_at":"2026-07-10T21:55:05Z","title":"Silent Failures in Quantized LLM Reasoning: A Taxonomy-Based Analysis of Hollow Convergence and Failure Mode Shifts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T01:09:27.619062Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.09999"},"observation_digest":"sha256:d96e83665602f004b51c3482fc43ffa471162da3875676464e791f5025f56e77","observation_id":"f3e9302a-6a15-4969-a71b-1c4e382d91d0","resolution":{"observed_at":"2026-07-14T01:09:27.619062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-02T07:32:09.425235Z","title":"Evaluating Quantized Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09999","last_updated":"2026-07-23T13:41:45Z","snapshot_observed_at":"2026-08-02T07:32:08.426717Z","submitted_at":"2026-07-10T21:55:05Z","title":"Silent Failures in Quantized LLM Reasoning: A Taxonomy-Based Analysis of Hollow Convergence and Failure Mode Shifts","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T07:32:09.425235Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.09999"},"observation_digest":"sha256:2a06914776354123794e9469db745507fff7837225a77e109df2ea8976d65e20","observation_id":"aa195c14-2a97-447f-b0b5-67b817eb6da2","resolution":{"observed_at":"2026-08-02T07:32:09.425235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-07-14T08:45:52.855783Z","title":"arXiv preprint arXiv:2402.18158 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10855","last_updated":"2026-07-12T17:39:09Z","snapshot_observed_at":"2026-08-06T03:10:18.618115Z","submitted_at":"2026-07-12T17:39:09Z","title":"Reliability Scaling Laws for Quantized Large Language Models","version":1},"reference_index":147,"source":"arxiv_source","source_observed_at":"2026-07-14T08:45:52.855783Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.10855"},"observation_digest":"sha256:518814ff817609944f72929c0591eca7e0d504a64ac7ecbc9514a274b604d072","observation_id":"d07172d7-c5a5-4169-ae9c-fa21a4da35a0","resolution":{"observed_at":"2026-07-14T08:45:52.855783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-01T14:11:08.947017Z","title":"Weixian Waylon Li, Mengyu Wang, and Tiejun Ma","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18867","last_updated":"2026-07-21T08:58:36Z","snapshot_observed_at":"2026-08-06T05:58:10.612475Z","submitted_at":"2026-07-21T08:58:36Z","title":"HindsightBench: A Black-Box Behavioral Audit Protocol for Parametric Hindsight in Time-Indexed LLM Decision Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T14:11:08.947017Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.18867"},"observation_digest":"sha256:54776dbe089b9fbbb6a22dffda8f7d54156e567bb5ac2ed3169cc2c862d1faff","observation_id":"77a50fc8-4e32-4fd5-abfa-13ed2c24cc7d","resolution":{"observed_at":"2026-08-01T14:11:08.947017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-01T04:48:26.573189Z","title":"arXiv:2402.18158","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22448","last_updated":"2026-07-27T23:08:28Z","snapshot_observed_at":"2026-08-08T03:02:00.797726Z","submitted_at":"2026-07-24T16:10:21Z","title":"Where Facts Go Missing: A Layerwise Taxonomy and Per-Layer Attribution of Information Omission in Air-Gapped LLMAgent Pipelines","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T04:48:26.573189Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.22448"},"observation_digest":"sha256:7206052cc53a36242d90883e6a603dea9503099a1bd5cf42d0404f06d7c1063e","observation_id":"95b8362e-7bda-4fa3-97a6-70d21818ffdd","resolution":{"observed_at":"2026-08-01T04:48:26.573189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-03T07:51:21.284174Z","title":"arXiv preprint arXiv:2402.18158 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-07T23:39:15.799185Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T07:51:21.284174Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:71f0c2e462a662c7be788f70488da9793b531a32b361b9097f21ea2c17eec1e6","observation_id":"ec3223d8-5603-4358-8451-54a6824152ac","resolution":{"observed_at":"2026-08-03T07:51:21.284174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18158","snapshot_observed_at":"2026-08-05T04:25:21.969659Z","title":"arXiv preprint arXiv:2402.18158 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29397","last_updated":"2026-08-04T16:14:13Z","snapshot_observed_at":"2026-08-07T23:39:15.799185Z","submitted_at":"2026-07-31T13:15:11Z","title":"Studying quantization trade-offs for efficient inference deployment in machine translation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T04:25:21.969659Z"},"links":{"cited_paper":"/paper/2402.18158","citing_paper":"/paper/2607.29397"},"observation_digest":"sha256:0be50c2f82e355e7dbb8492e6160af2fe3a91e33a54b4aea8166784f316e6ec9","observation_id":"21f944eb-a174-4f2c-8927-6569e53c812e","resolution":{"observed_at":"2026-08-05T04:25:21.969659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.18158/citation-record","integrity":"/paper/2402.18158/integrity","json":"/paper/2402.18158/citation-record.json","paper":"/paper/2402.18158"},"outbound":[],"paper":{"arxiv_id":"2402.18158","last_updated":"2024-06-06T07:30:44Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:30:27.397319Z","submitted_at":"2024-02-28T08:43:05Z","title":"Evaluating Quantized Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2402.18158."}