{"as_of":"2026-08-23T00:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1a9b8fc2b3ab6f3d258ae3bc49b3d83d8f463fff2981101ea5f3bc2667e542e9","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T11:08:18.802098Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T05:45:42.295527Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T05:49:41.102953Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.23200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.23200","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"822a8433-186a-4d7b-9132-d6b85d2aed3f","year":2026},"citing_paper":{"arxiv_id":"2605.17887","last_updated":"2026-05-18T05:53:09Z","snapshot_observed_at":"2026-08-15T13:59:59.163692Z","submitted_at":"2026-05-18T05:53:09Z","title":"Attention Sinks and Outliers in Attention Residuals","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T12:12:20.271730Z"},"links":{"cited_paper":"/paper/2602.23200","citing_paper":"/paper/2605.17887"},"observation_digest":"sha256:93d1e5e2b44f545fed6dcaaf71eb36999494c36f9a2055ccd69ecbd023b11498","observation_id":"a76ce9c5-ed83-423e-97a2-5b6a268f2355","resolution":{"observed_at":"2026-05-22T02:03:28.708618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"cited_work":{"arxiv_id":"2602.23200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.23200","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"822a8433-186a-4d7b-9132-d6b85d2aed3f","year":2026},"citing_paper":{"arxiv_id":"2605.20868","last_updated":"2026-05-20T08:04:40Z","snapshot_observed_at":"2026-08-12T22:16:32.837291Z","submitted_at":"2026-05-20T08:04:40Z","title":"Runtime-Certified Bounded-Error Quantized Attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T05:45:42.295527Z"},"links":{"cited_paper":"/paper/2602.23200","citing_paper":"/paper/2605.20868"},"observation_digest":"sha256:fdb284fd231294e59a18747bb7f8678b78fdf9cad4d0d5f9352f603bfe7ef6a6","observation_id":"8680b66d-eaf9-4558-915f-3fdc45761f1b","resolution":{"observed_at":"2026-05-22T02:03:28.708618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.23200/citation-record","integrity":"/paper/2602.23200/integrity","json":"/paper/2602.23200/citation-record.json","paper":"/paper/2602.23200"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:4d8568b8ec2246b4f4b9e31ad8a0b49357f0dd01ffb3be269d0068fe73e47cbf","observation_id":"24453ac2-98e2-4080-a071-83064b587841","resolution":{"observed_at":"2026-05-22T11:11:27.207748Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Duanmu, Z","venue":null,"work_id":"f0dffe8b-67c7-4bef-9ac0-d82549555f88","year":null},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:60b4d8699c3c8e2c5dfc8f5ed4c41264dfefa8ddfe72606bb86378872f9a8723","observation_id":"a35bcf98-9546-4e5f-ac1d-1f75f3fc5617","resolution":{"observed_at":"2026-05-22T11:11:27.823771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"736ce963-a217-4a79-a52c-76af8530077d","year":null},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:9a976e62d3e2cd75d454bcce6fa5316ff313eadea4d9b2819fa04408aad8cb95","observation_id":"a2b5bbb0-61ef-4d8f-a78d-434ab5852146","resolution":{"observed_at":"2026-05-22T11:11:27.820500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1260860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:47:14.558044Z","title":"He, B., Yin, L., Zhen, H.-L., Liu, S., Wu, H., Zhang, X., Yuan, M., and Ma, C","venue":null,"work_id":"e7e9d443-273d-4722-8ec7-59adb893de0e","year":2024},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:81eb9e00194bb0afdf2061ebe117306dfe67d8dfa0e09ac8cc9704fd27a60f86","observation_id":"f568608e-8b9c-44b0-b63a-41b5a586a963","resolution":{"observed_at":"2026-05-22T11:11:27.410914Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:1dd45e9d8b2dc66e0385743091864a7f52a7831444706653ba23f588ebc3cb01","observation_id":"5d7866d4-0f50-4652-a7af-8fbea52b2616","resolution":{"observed_at":"2026-05-22T11:11:27.223217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-0040","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hooper, S","venue":null,"work_id":"55572e14-9401-44c5-b557-be37695a3626","year":2024},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:126724a35eaa75ea4a69c20fe8408ee982f6d29ee2ec77f28a72355e6d39840c","observation_id":"375895ae-181e-45f8-a756-36c03e7b6fd2","resolution":{"observed_at":"2026-05-22T11:11:27.230148Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-07T23:38:12.874356+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T23:38:12.874356+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c79a0462-d4a7-4c0c-9b05-b9aa43ebd54e","year":null},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:c89a5512ae5ecb122ae94ebf32f5abbc20d4a777452d7bcfc726374c7c6d8adf","observation_id":"9c68e95a-e6a1-4da9-8b4d-27804e642fdc","resolution":{"observed_at":"2026-05-22T11:11:27.835575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d5f29316-2f0d-4228-a57f-82c6dd577cd8","year":null},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:c2d1d671770a176d041b78d80ec7fa0abf385291d4ed92f64a68935cb177c6cf","observation_id":"6be08cf9-4905-40b9-97f2-4228f8b65a91","resolution":{"observed_at":"2026-05-22T11:11:27.829564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-4443","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Minicache: Kv cache compression in depth dimension for large language models","venue":null,"work_id":"579b8d80-1eb5-4a9c-8c80-5869515e0475","year":2024},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:6b4b079bcca30cff5f495abca2bff35e8cf705296fa29238a0006f8ee3c9302a","observation_id":"c969a104-5424-4b8d-bfe1-e951e5b12e3f","resolution":{"observed_at":"2026-05-22T11:11:27.226589Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:00.80536+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:00.80536+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-08-12T17:03:50.984887Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":"2402.02750","doi":"10.48550/arxiv.2402.02750","metadata_source":"pith","pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","venue":"cs.CL","work_id":"735737c3-24e5-41c3-ab4f-04edcb36731c","year":2024},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:2aa7858554fcdfd11de13889f9a7fc3f0a6f1505e0cc9706ef86bef1df59e167","observation_id":"22504581-165f-406d-97c2-662792667288","resolution":{"observed_at":"2026-05-22T11:11:27.235425Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2f065f1e-8e55-48b5-ab7b-00bb347a0ea6","year":2023},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:0cd50551685ebb3dc7f4bc93c8e58860c11c905b8409adedea808efb137b25f2","observation_id":"7f67dbc7-3bff-429b-aa6a-f741ceb0d8da","resolution":{"observed_at":"2026-05-22T11:11:27.838440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sanovar, S","venue":null,"work_id":"c86cde6d-c7c5-4cac-9e79-8a30c48fc1ae","year":2025},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:da19e3d000e4b9de9a47fe4edc6d0c4aa0f3dc28b97c07a1bad239db729247e6","observation_id":"497ce4e7-0c9b-4d5b-adc4-80930e770342","resolution":{"observed_at":"2026-05-22T11:11:27.826629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Su and K","venue":null,"work_id":"7eff9340-67e6-432d-8a04-f4bc8e280690","year":2025},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:2bb716384a96a89263485023e1984e8e71e3e102224eb98ab393fd4ce4b265d4","observation_id":"6dc23691-0a07-49aa-a994-8f521d175950","resolution":{"observed_at":"2026-05-22T11:11:27.832532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:bf8227a64afdf30315d9fd1a67b7010c0a739214faafc6476a03aa20d0d18b4f","observation_id":"2386a0b3-2f29-4721-a85f-e3da57887fa5","resolution":{"observed_at":"2026-05-22T11:11:27.212718Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24358","last_updated":"2025-07-28T20:44:23Z","snapshot_observed_at":"2026-08-20T19:55:06.721470Z","submitted_at":"2025-03-31T17:37:32Z","title":"SQuat: Subspace-orthogonal KV Cache Quantization","version":2},"cited_work":{"arxiv_id":"2503.24358","doi":"10.48550/arxiv.2503.24358","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.24358","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SQuat: Subspace-orthogonal kv cache quantization.arXiv preprint arXiv:2503.24358, 2025","venue":"ArXiv.org","work_id":"07f4d5ad-3238-4fae-bffb-6fb8acf3ddaf","year":2025},"citing_paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T11:08:18.802098Z"},"links":{"cited_paper":"/paper/2503.24358","citing_paper":"/paper/2602.23200"},"observation_digest":"sha256:293151c9542ded587eae483df4ad6a5a5d65cf05036324b159aae717925b8b2f","observation_id":"55eca5c1-86d4-4cae-afc1-24a1fc834494","resolution":{"observed_at":"2026-05-22T11:11:27.217969Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2602.23200","last_updated":"2026-05-20T19:15:57Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T06:59:42.363846Z","submitted_at":"2026-02-26T16:50:36Z","title":"InnerQ: Hardware-Aware Tuning-Free Quantization of KV Cache for Large Language Models"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":4,"verified_exact":5,"verified_fuzzy":3},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 2 inbound Pith citation observations for arXiv:2602.23200."}