{"as_of":"2026-08-06T17:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6f0c9c7f1c92a0a006a01fa6c4708d6162f5c2be872501b2fe1c4ef38143d3b","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T06:56:51.829741Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:38.647231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T00:49:18.139563Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-08-06T14:45:38.647231Z","title":"Mixllm: Llm quantization with global mixed-precision between output-features and highly-efficient system design","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18073","last_updated":"2025-07-24T03:55:19Z","snapshot_observed_at":"2026-08-06T14:36:21.955779Z","submitted_at":"2025-07-24T03:55:19Z","title":"Squeeze10-LLM: Squeezing LLMs' Weights by 10 Times via a Staged Mixed-Precision Quantization Method","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:45:38.647231Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2507.18073"},"observation_digest":"sha256:b6c0aac07769e2315385286c1b95a78c56cce4e4f30bea605d0721180b2849ed","observation_id":"2485f3ff-a7bd-485d-a157-0c9e71abb003","resolution":{"observed_at":"2026-08-06T14:45:38.647231Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":"2412.14590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-04T00:49:18.139563Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","venue":"cs.LG","work_id":"c4d7fa5b-fdc9-48d3-908e-c3214b7aa67b","year":2024},"citing_paper":{"arxiv_id":"2605.19929","last_updated":"2026-05-19T14:49:57Z","snapshot_observed_at":"2026-08-02T05:44:37.705586Z","submitted_at":"2026-05-19T14:49:57Z","title":"Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T05:20:45.264341Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2605.19929"},"observation_digest":"sha256:0392d28e844afd8a9f322c23720cf9169141ca254f4aac13550d1194a1d6955a","observation_id":"f7421b5f-a3f4-4fec-90df-40557947d13d","resolution":{"observed_at":"2026-05-20T05:23:03.651022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":"2412.14590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-04T00:49:18.139563Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","venue":"cs.LG","work_id":"c4d7fa5b-fdc9-48d3-908e-c3214b7aa67b","year":2024},"citing_paper":{"arxiv_id":"2606.19558","last_updated":"2026-06-17T19:59:26Z","snapshot_observed_at":"2026-08-05T01:20:55.550340Z","submitted_at":"2026-06-17T19:59:26Z","title":"Displacement Is Not Direction: Evaluating Fidelity Metrics for Quantized LLM Deployment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T20:58:33.720040Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2606.19558"},"observation_digest":"sha256:ea32f335d6d01a1c206086142861b7b747a0a0f925ae11069439bd05f1bedd47","observation_id":"357fa1c1-a011-493d-b621-bca2b712eb82","resolution":{"observed_at":"2026-07-04T00:49:18.141527Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14590","snapshot_observed_at":"2026-07-12T06:20:07.112455Z","title":"MixLLM: LLM quantization with global mixed- precision between output-features and highly-efficient system design","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.02893","last_updated":"2026-07-03T02:42:04Z","snapshot_observed_at":"2026-08-06T14:41:53.505619Z","submitted_at":"2026-07-03T02:42:04Z","title":"Variable Bit-width Quantization: Learning Per-Group Precision for \"Bigger-but-Smaller\" Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-12T06:20:07.112455Z"},"links":{"cited_paper":"/paper/2412.14590","citing_paper":"/paper/2607.02893"},"observation_digest":"sha256:623a21bed52d106c8587b830b83ae4be3bafffd0e745668e3dd68a11b1b0e559","observation_id":"58e27d8e-bafb-43ad-9522-5e1bd0616350","resolution":{"observed_at":"2026-07-12T06:20:07.112455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14590/citation-record","integrity":"/paper/2412.14590/integrity","json":"/paper/2412.14590/citation-record.json","paper":"/paper/2412.14590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cffb2791-894b-47a1-bb41-43e217b5916e","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:6a1ccbdf968a590226c58b5861538c2ca3fae84c26261bd16c65b12caff1d4c5","observation_id":"37e62c2a-8bcb-451e-ae7e-285763dcdce8","resolution":{"observed_at":"2026-05-23T06:57:41.068343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":"53c016af-dc6e-4a80-aded-629daab8ae9b","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:30aa712c27a2eef20d7864eb863a290b4be55915b63e26799239c57d0ecdbd60","observation_id":"80233a95-9765-431e-8da9-c8aec65df4f4","resolution":{"observed_at":"2026-05-23T06:57:41.060729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00456","last_updated":"2024-10-29T11:09:12Z","snapshot_observed_at":"2026-08-05T10:45:45.389337Z","submitted_at":"2024-03-30T19:20:06Z","title":"QuaRot: Outlier-Free 4-Bit Inference in Rotated LLMs","version":2},"cited_work":{"arxiv_id":"2404.00456","doi":"10.48550/arxiv.2404.00456","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Croci, Bo Li, Martin Jaggi, Dan Alistarh, Torsten Hoefler, and James Hensman","venue":"arXiv (Cornell University)","work_id":"b0bace20-bbcd-45d2-99df-9bf26e089b47","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2404.00456","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:f99b0c9ae3ad5e487983785a91dae282cd6322b641102e4d74d66bd1905a0659","observation_id":"3d05d206-a179-4663-894f-efe5f138528e","resolution":{"observed_at":"2026-05-23T06:57:40.303236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c3fb2d45-2463-4d82-b167-51147a351af7","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7a57b60482089b039704bc6c9628932ff8af0e808cc71e34737843d4aa8f3cfb","observation_id":"a79ce376-f19e-4d98-b145-ba71dbc37eb5","resolution":{"observed_at":"2026-05-23T06:57:41.066006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autogptq","venue":null,"work_id":"0d92ccb1-93df-43e3-9c0e-5a38a5c8f650","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:80807f0ef8ad9c9245dc40d6cc0a8fc0222fbe4aff75f9eb2b9d0909d34f320e","observation_id":"9e2c2e61-c1ba-4ead-b6a2-fa5ad332ef80","resolution":{"observed_at":"2026-05-23T06:57:41.063348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A systematic classification of knowledge, reasoning, and context within the ARC dataset","venue":null,"work_id":"4c969357-f4fd-44fe-a5d3-32c976a834bb","year":2018},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:4ed94fc35f0aedcf79bdbaee03cf06605454d8ba860149f14e2b2ac1d21eca94","observation_id":"b435e830-b05f-4aed-a269-f03613b4b5c5","resolution":{"observed_at":"2026-05-23T06:57:41.076269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":"2303.12712","doi":"10.48550/arxiv.2303.12712","metadata_source":"pith","pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","venue":"cs.CL","work_id":"a23cfe92-7f7c-424b-98d4-b386a83002fb","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1fd25d830801d8977f0b9ef87189daf50a8df1305eb21c4aeff91b3b474e10a8","observation_id":"328dbda5-aab3-4f19-9012-b69289a0ed10","resolution":{"observed_at":"2026-05-23T06:57:40.294413Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quip: 2-bit quantization of large language models with guarantees","venue":null,"work_id":"8ed4da23-d795-4bb5-9d5a-ef1276c51e7f","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:97902c1bd7ec9fec2d12f748407d7f6fa82aae6ff833fe1d9b0841730cd5a393","observation_id":"cf5f2a50-3df0-4687-92a0-c22a5f281592","resolution":{"observed_at":"2026-05-23T06:57:41.073634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4529776d-a940-47ac-b870-ef2d42693d1b","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:81e8af5099656c2d72f7664d4b712a874daac46d275c7ffefd7856be95b96673","observation_id":"44d0ce27-b02e-4ede-9552-4d15ae1f48d9","resolution":{"observed_at":"2026-05-23T06:57:41.071072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"cited_work":{"arxiv_id":"2208.07339","doi":"10.18653/v1/2020.findings-emnlp.314","metadata_source":"pith","pith_arxiv_id":"2208.07339","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","venue":"cs.LG","work_id":"98201f98-f4e5-4d1c-9ed7-b795e3c8f76c","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2208.07339","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:3fd8de4c480f5c5182bf202ffd9f645efbe48b0a7acff6519fdf0c9d8168df80","observation_id":"b567af91-f51d-4045-b786-727f64249083","resolution":{"observed_at":"2026-05-23T06:57:40.298346Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spqr: A sparse-quantized representation for near-lossless LLM weight compression","venue":null,"work_id":"acf7ad51-53ae-4706-b8c0-99200186b7fa","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:ae511048c6d14b547ca5f396c314b8d55dc0683ffa0122966a92fc4749ed0ace","observation_id":"36e87cfe-e0b8-4882-80f6-23765d942231","resolution":{"observed_at":"2026-05-23T06:57:41.133770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"1a35cad2-4590-453f-9a97-642790da8a95","year":2019},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:6d0ed5536f3bf0c9d37440a2980b1f397023fabfe4ea03f1fa70e3b03e4e6813","observation_id":"5dd118ca-c11b-4669-9c0a-5f7cfc8f4d10","resolution":{"observed_at":"2026-05-23T06:57:41.136046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimal brain compression: A framework for accurate post-training quantization and pruning","venue":null,"work_id":"65d64961-1427-41ff-b7ba-f19b3bc49650","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:67bb2e35f1b363ff62cf2175756489f04aad245bebb5fa4f3c9701a95d850bea","observation_id":"625e4c1c-2724-4088-9700-81c4b2dfb807","resolution":{"observed_at":"2026-05-23T06:57:41.131468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-07-31T03:44:36.976336Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":"2210.17323","doi":"10.48550/arxiv.2210.17323","metadata_source":"pith","pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","venue":"cs.LG","work_id":"19ed8c44-202a-48f6-8169-637d5a5f2408","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7e6175f3ac19ab3c6f3b4d5c0a1674f59937874de3e737cdce96d88fb7d21c8d","observation_id":"7d4685eb-7449-43f7-8289-f7c56f092f09","resolution":{"observed_at":"2026-05-23T06:57:40.248123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:03.028003+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":"4f7e8b7b-9bd8-4bd1-b6ce-0df501e41450","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:feb4bde080c6f2097516802be4dd4052fe020d638c8130694c974d2b6a36796b","observation_id":"c7e285a5-b683-40a4-abc5-450fa0e3c48c","resolution":{"observed_at":"2026-05-23T06:57:41.145836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-03T06:33:46.668360Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":"2403.17887","doi":"10.48550/arxiv.2403.17887","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The unreasonable ineffectiveness of the deeper layers.arXiv preprint arXiv:2403.17887","venue":"arXiv (Cornell University)","work_id":"93761c3c-6e0f-41d0-a8ea-17b8d13c3387","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:58f3357d96d189e9c32482226dbda72d78cdaae36b5bba8e394c24229f8eb990","observation_id":"15924654-a6e9-4bb0-a154-96407715c746","resolution":{"observed_at":"2026-05-23T06:57:40.285477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen2.5: A party of foundation models","venue":null,"work_id":"bd478a0d-7741-4f6b-b8d3-a747e57c8aa5","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:e7ca7982a3070c35bbe4ffe87eb9dd451107e30934c52e25bd30a1a1a34f6471","observation_id":"3c2d872c-6dc6-4506-bb6f-d8a2b6a34909","resolution":{"observed_at":"2026-05-23T06:57:41.127122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stork, and Gregory J","venue":null,"work_id":"0557339e-c26f-433d-86e8-934ae050a827","year":1993},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:243071855aac51e86704a0ab1cb2067e484d633cff4f04ae6aa98f833fe8d273","observation_id":"2b793956-7161-48b8-8df3-de9b75fb91c2","resolution":{"observed_at":"2026-05-23T06:57:41.129322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08671","last_updated":"2024-01-09T06:49:40Z","snapshot_observed_at":"2026-07-06T17:16:25.682072Z","submitted_at":"2024-01-09T06:49:40Z","title":"DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference","version":1},"cited_work":{"arxiv_id":"2401.08671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.08671","snapshot_observed_at":"2026-07-04T11:59:50.582581Z","title":"Deepspeed-fastgen: High-throughput text generation for llms via MII and deepspeed-inference","venue":null,"work_id":"d970e106-3cea-4d01-88f2-f4ffc759b0da","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2401.08671","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:c82449aec959157e850ab3be89dec3082e9df9342ebf4ea5cfe2d511607acc3c","observation_id":"0c8721d8-0d08-4ff2-ad35-51587c21c02f","resolution":{"observed_at":"2026-05-23T06:57:40.262382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:eb4f3b3971d379bc0f827fe848b8b23d08244f765eaa946c5d0819f77467aea1","observation_id":"dd189893-7f68-4131-ae81-4c7c4203e583","resolution":{"observed_at":"2026-05-23T06:57:40.289405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, and Kurt Keutzer","venue":null,"work_id":"2252e356-f698-40d8-b6d7-732cf3293e7d","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:237a48c6cf62f4dfc1e62403cadb8fea71b69a7b491089480e5260283f91e4b3","observation_id":"fccbe28f-94f4-442d-b8c0-fcc1435bc337","resolution":{"observed_at":"2026-05-23T06:57:41.140885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04330","last_updated":"2024-11-30T02:42:31Z","snapshot_observed_at":"2026-08-04T07:47:22.112536Z","submitted_at":"2024-11-07T00:10:10Z","title":"Scaling Laws for Precision","version":2},"cited_work":{"arxiv_id":"2411.04330","doi":"10.48550/arxiv.2411.04330","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.04330","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spector, Blake Bordelon, Niklas Muennighoff, Mansheej Paul, Cengiz Pehlevan, Christopher Ré, and Aditi Raghunathan","venue":"arXiv (Cornell University)","work_id":"988bd25e-4ff9-47cd-89f4-f30e112706ec","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2411.04330","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:76ff1d181966aea5d391582df268bd2e7f88335bcd27680396d0de5b6cf9bd08","observation_id":"7ebcf684-9784-4b84-b16c-b8a1dc19ec57","resolution":{"observed_at":"2026-05-23T06:57:40.270961Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Joseph Hassoun, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"72f21cec-3f3e-4cc0-afc7-acd7b67584fa","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:b8f880fffa4b17b3f4d6d381e59bd2e0da9f699966258253d25854fb27e3c34d","observation_id":"5d490239-93d0-46b6-87d2-8ccca3958243","resolution":{"observed_at":"2026-05-23T06:57:41.107546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denker, and Sara A","venue":null,"work_id":"f639513c-78bb-4bbc-add0-31a3b8f35003","year":1989},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:324a02fd546216c0f2cdc6ed976ed3f4592925f87deb36b994da03bd2817f851","observation_id":"77a1fb6c-d6b1-455a-9e77-e80c3881cf1a","resolution":{"observed_at":"2026-05-23T06:57:41.124803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWQ: outlier-aware weight quantization for efficient fine-tuning and inference of large language models","venue":null,"work_id":"191960e8-5a26-4065-8cb2-318a5fd7ac5a","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:2aba7de01aba4c9badd9c992a4e5e612c7a7e0d635f046f6403520fdcfc93736","observation_id":"46af8c01-ddc2-46c9-8737-68ebd542122a","resolution":{"observed_at":"2026-05-23T06:57:41.117685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"AWQ: activation-aware weight quantization for on-device LLM compression and acceleration","venue":null,"work_id":"b6b5c58d-fce8-4be1-9edb-2499f9f9bdfa","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:ac181f35a49c86ea2dfad6ebed6d8a12dbc88e5e44635faa941a85475d9f18cc","observation_id":"96ff1376-e8d0-45d4-bd22-8ccefc5e0f74","resolution":{"observed_at":"2026-05-23T06:57:41.119902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-07-06T18:11:09.767624Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":"2405.04532","doi":"10.48550/arxiv.2405.04532","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qserve: W4A8KV4 quantization and system co-design for efficient LLM serving.CoRR, abs/2405.04532","venue":"arXiv (Cornell University)","work_id":"c210d46c-8391-4e16-ac58-5568cd278fc1","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:8caceebc9cae461b0d0c0f406780dc4562380df9058a885ded08da3a9b6550a5","observation_id":"25cf0132-d301-4547-b25e-42fbae3358b2","resolution":{"observed_at":"2026-05-23T06:57:40.275531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:49:58.779354+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:49:58.779354+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16406","last_updated":"2025-02-20T06:07:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-26T02:15:49Z","title":"SpinQuant: LLM quantization with learned rotations","version":4},"cited_work":{"arxiv_id":"2405.16406","doi":"10.48550/arxiv.2405.16406","metadata_source":"pith","pith_arxiv_id":"2405.16406","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SpinQuant: LLM quantization with learned rotations","venue":"cs.LG","work_id":"489855f8-bd1c-4c87-a334-f6ab27d6707d","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2405.16406","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:a871500b5239a3ff2b7051ce7ec7f3fb72c9e49e578d6eabdef7958694f9d66b","observation_id":"5cc3f7dc-0408-44ef-8b6a-a465057f4807","resolution":{"observed_at":"2026-05-23T06:57:40.266681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Affinequant: Affine transformation quantization for large language models","venue":null,"work_id":"5f8b063e-9e9c-493b-9407-934278b1bf33","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:cb14db7fef3a74164a3aea1368590d3606d9217981fe214bbd56ae693f0e2fdd","observation_id":"082821a9-6969-4256-a07e-71703f945bdf","resolution":{"observed_at":"2026-05-23T06:57:41.122100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":"2403.03853","doi":"10.48550/arxiv.2403.03853","metadata_source":"pith","pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shortgpt: Layers in large language models are more redundant than you expect","venue":"cs.CL","work_id":"195a45aa-5b87-4058-97eb-f08eca8ee8c6","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:bd7afdc58d65f4cc90208ff0c18bb197abe9b249351d9c050da3684e639c4771","observation_id":"c5fa5e41-febb-4a3d-acb1-bc99b492e866","resolution":{"observed_at":"2026-05-23T06:57:40.238529Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"11924862-857f-44a3-8657-5e0a636db68c","year":2017},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:0cb35f70a377a394f3f0ecf9db112c52665ca625cdde1866314d83bd611701a8","observation_id":"27706596-3357-4875-9fb2-efb2ad40f6f8","resolution":{"observed_at":"2026-05-23T06:57:41.109864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"db8c0e02-6880-4fbd-b6cd-71d5a8aacf70","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:d1b467b8513b2c541d6e870ded0d42d9b56a2c66140a926a6a2e75afa767a8b2","observation_id":"5925bd4b-8abd-4459-8de0-e2626acedd48","resolution":{"observed_at":"2026-05-23T06:57:41.138711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf33b586-cf27-4ff6-9ad1-9036725ec4fe","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:ddb7b84ba0fe2e94c004fd6b003c2aac15a6809285af0865e56467814497b3c3","observation_id":"7ee67852-e4db-4291-b213-f86024dfce4a","resolution":{"observed_at":"2026-05-23T06:57:41.112699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"345554b8-f956-42a9-9516-6ff1003ba5c0","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:b993c0e484f3196d899da3e4c3fb8ccf41905bf51532b15db51998c6b7a4af6a","observation_id":"24699ae9-ba64-4717-8032-0503701a09f8","resolution":{"observed_at":"2026-05-23T06:57:41.115047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4abfd228-83d1-43ff-8f42-05be6b8f6eda","year":2020},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:ad89629e5b56ff58ae8c364326d12b28510e3c707c3aed9af7f7cf0219d3f83a","observation_id":"70aa6d0d-76cc-418b-9d3e-b091e345afaf","resolution":{"observed_at":"2026-05-23T06:57:41.105230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":"2311.12022","doi":"10.48550/arxiv.2311.12022","metadata_source":"pith","pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","venue":"cs.AI","work_id":"9e2a976b-f5ad-4aee-af5c-243fe0fe75d2","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:56a93aed3c48865cfe15dd0e047294b8f6d6ac0db7b44da26e483f2f8e42e824","observation_id":"df2d04e5-ba55-4ded-9db7-d4e2e52ad99f","resolution":{"observed_at":"2026-05-23T06:57:40.233060Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:46.941438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omniquant: Omnidirectionally calibrated quantization for large language models","venue":null,"work_id":"ec9d0af3-9cdb-4fde-8899-49b925c12493","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:0621b3504ed334940bbe4c663dc246731c53ca3182d5fc3a277728f05567ca9e","observation_id":"150ed859-5ba6-42ea-b95d-902aab744314","resolution":{"observed_at":"2026-05-23T06:57:41.100063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Musr: Testing the limits of chain-of-thought with multistep soft reasoning","venue":null,"work_id":"44136783-f25d-4dba-a343-16e0053aff4e","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:da5c1f587d3fe74119abf9c8306802a59a534c337a89d701e7aa85c8acc917a3","observation_id":"9a916006-04de-4242-a580-cce8adaaf96f","resolution":{"observed_at":"2026-05-23T06:57:41.097254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Le, Ed H","venue":null,"work_id":"0af6f096-4adb-4c5b-b092-c7a1a9771794","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:4c28143926ace66b7f689bb4727212124cdeca1345ae7ce26594b0eb63e2f4a0","observation_id":"9ab5c030-5907-41f6-9520-ca5bbb367aad","resolution":{"observed_at":"2026-05-23T06:57:41.102699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tensorrt-llm","venue":null,"work_id":"eb3a4f3e-4ef1-4a1a-bf35-ba65e6e439df","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:3490e4e9799382de13e6add9cb8b366558e4bdfccc766729311c41586aea749a","observation_id":"1af3be82-8754-4986-9e91-b642720089cf","resolution":{"observed_at":"2026-05-23T06:57:41.091846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":"2406.01574","doi":"10.1145/3711896.3737413","metadata_source":"pith","pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","venue":"cs.CL","work_id":"3c028052-035a-4c22-b80e-3046edb44adc","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1e67f345dcc820545686cd96836d26c57a21873b14862caa518f6d8c4011c4fc","observation_id":"14bf5fc2-f624-4d6f-8bad-89df8cbd4141","resolution":{"observed_at":"2026-05-23T06:57:40.280362Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08583","last_updated":"2023-12-18T05:08:23Z","snapshot_observed_at":"2026-08-06T16:35:56.103062Z","submitted_at":"2023-12-14T01:06:37Z","title":"ZeroQuant(4+2): Redefining LLMs Quantization with a New FP6-Centric Strategy for Diverse Generative Tasks","version":2},"cited_work":{"arxiv_id":"2312.08583","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.08583","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zero- quant(4+2): Redefining llms quantization with a new fp6-centric strategy for diverse generative tasks","venue":null,"work_id":"06af1687-0281-4f80-9aad-d534be167f0c","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2312.08583","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:1f6e47770961b77129e6d344daf31c9e3f1f7c8c34ac7019d0ff99d6018288fe","observation_id":"eed79741-d8c4-4379-8170-d62df4d12977","resolution":{"observed_at":"2026-05-23T06:57:40.258320Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flash-llm: Enabling low-cost and highly-efficient large generative model inference with unstructured sparsity","venue":null,"work_id":"11bbbc76-1152-40d5-bc1b-d9d0996fdef1","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:c4538559a6c2a2cb5f025091353989dcc86706c6bfa9e285e480ad6f10def409","observation_id":"76c4fb00-95ce-4142-b113-fc6415d154b3","resolution":{"observed_at":"2026-05-23T06:57:41.094814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Quant-llm: Accelerating the serving of large language models via fp6-centric algorithm-system co-design on modern gpus","venue":null,"work_id":"1dbb937e-5235-481b-a0ae-6c47d28bc089","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:4604ae46d7dd1e3fdfc98434e168a919ac08c8f788f5fe1641515f91de0478e3","observation_id":"a272b44b-2ee9-4610-80eb-f1e7cca57fee","resolution":{"observed_at":"2026-05-23T06:57:41.143164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smoothquant: Accurate and efficient post-training quantization for large language models","venue":null,"work_id":"96f9952a-c8f5-433b-a986-76c623fecb4f","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:acc7e2e93b1db327f5241c76d052f7c27deaa7c6f023e84b646f8344da012f89","observation_id":"852e474e-3a66-475d-af0f-0d40db242d5b","resolution":{"observed_at":"2026-05-23T06:57:41.087377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zeroquant: Efficient and affordable post-training quantization for large-scale transformers","venue":null,"work_id":"1e6ffbbb-2769-491a-beb8-3bd86c3b80ca","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:445649a1eaae4f6b21d3046c049246abfc952cd106aec702fcf4f407e88f01ba","observation_id":"b98ecc84-49b8-424c-806e-381e79472077","resolution":{"observed_at":"2026-05-23T06:57:41.084338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Orca: A distributed serving system for transformer-based generative models","venue":null,"work_id":"ab8fc7f5-2e3e-427a-a113-9f17fccb4614","year":2022},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:42aa4b01dd8c8465b362da4754ecc6710cd4d8bce4a365dcd4794acdebca0938","observation_id":"06da1fc8-e47f-4710-8f4f-da7a2c3af0d9","resolution":{"observed_at":"2026-05-23T06:57:41.089673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01089","last_updated":"2023-05-17T10:07:33Z","snapshot_observed_at":"2026-07-06T15:11:32.429514Z","submitted_at":"2023-04-03T15:46:15Z","title":"RPTQ: Reorder-based Post-training Quantization for Large Language Models","version":4},"cited_work":{"arxiv_id":"2304.01089","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2304.01089","snapshot_observed_at":"2026-07-04T20:00:08.944266Z","title":"RPTQ: reorder-based post-training quantization for large language models","venue":null,"work_id":"b931b4e1-c0f8-42b7-b4ac-e82847daa65c","year":2023},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2304.01089","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:2acf807709284223978befe80289e2ec5cdedc53a87f494509a182d0e8af42d2","observation_id":"f4de0dba-4110-4ca8-9826-474856e95ec3","resolution":{"observed_at":"2026-05-23T06:57:40.243433Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hellaswag: Can a machine really finish your sentence? In Anna Korhonen, David R","venue":null,"work_id":"28240578-c0c5-438c-83ab-01801b3ae2eb","year":2019},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:7f9ee13e7f100bae2819172c2bd5a73a67b30a5507a8a4f3ef8c0bdb2c30ac0b","observation_id":"1c153e90-38a1-464b-9575-64af6d836d91","resolution":{"observed_at":"2026-05-23T06:57:41.079285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Atom: Low-bit quantization for efficient and accurate LLM serving","venue":null,"work_id":"6b827396-f667-47d5-a8d9-f7c750542972","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:93cf1a71848b96d985be678bf98807ae8e7c673d48dc028c3afc0ae8ced68d66","observation_id":"288a7325-3656-4722-bda6-b4afa6948d63","resolution":{"observed_at":"2026-05-23T06:57:41.081983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03594","last_updated":"2026-04-22T15:33:51Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-11-29T05:57:37Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","version":3},"cited_work":{"arxiv_id":"2412.03594","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.03594","snapshot_observed_at":"2026-07-02T17:27:14.639995Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","venue":"cs.CL","work_id":"cc16229c-90d6-4f31-95b8-37dd36ca157c","year":2024},"citing_paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-23T06:56:51.829741Z"},"links":{"cited_paper":"/paper/2412.03594","citing_paper":"/paper/2412.14590"},"observation_digest":"sha256:f792994ff57864100bf533af953e852f4477cb2446e61294e95d0a1dc509c9c1","observation_id":"3c7fae06-d6b4-4e1a-8f53-58f68161af7f","resolution":{"observed_at":"2026-05-23T06:57:40.253161Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.14590","last_updated":"2026-04-22T15:43:48Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T01:50:37.847212Z","submitted_at":"2024-12-19T07:15:15Z","title":"MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":7,"verified_exact":14,"verified_fuzzy":28},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 4 inbound Pith citation observations for arXiv:2412.14590."}