{"as_of":"2026-08-20T05:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fba1823168502f18f089cf142035b3c4a157d9b4e8b082276bff3bbc45418c27","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:49:24.164784Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:54:14.045740Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:57:26.279666Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2506.18879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-07-02T22:57:26.279666Z","title":"Li, J., Zhang, Y ., Hassan, M","venue":null,"work_id":"32b03174-efd6-4f84-949d-6ec263a707dd","year":2025},"citing_paper":{"arxiv_id":"2602.02958","last_updated":"2026-05-05T23:46:52Z","snapshot_observed_at":"2026-08-13T20:12:55.440957Z","submitted_at":"2026-02-03T00:54:32Z","title":"Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T07:58:24.456859Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2602.02958"},"observation_digest":"sha256:1b31cd767c6fd185306d0d89a900de80a65d8ff98b9a1f62e01b7054d6fa2fba","observation_id":"76071d9d-43e9-4def-a737-eae415b75c2e","resolution":{"observed_at":"2026-05-16T08:00:44.674074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2506.18879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-07-02T22:57:26.279666Z","title":"Li, J., Zhang, Y ., Hassan, M","venue":null,"work_id":"32b03174-efd6-4f84-949d-6ec263a707dd","year":2025},"citing_paper":{"arxiv_id":"2602.03922","last_updated":"2026-05-14T20:00:35Z","snapshot_observed_at":"2026-08-15T23:55:24.052057Z","submitted_at":"2026-02-03T18:50:00Z","title":"Online Vector Quantized Attention","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T13:42:51.275943Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2602.03922"},"observation_digest":"sha256:200c07b936a6fae952d0eb9bbd236dddfb9af1ccfc8f35c8e3fb1ec88427808a","observation_id":"5a97a9e5-6480-4ca3-863f-8a8defbb5ceb","resolution":{"observed_at":"2026-05-21T13:44:11.453481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2506.18879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-07-02T22:57:26.279666Z","title":"Li, J., Zhang, Y ., Hassan, M","venue":null,"work_id":"32b03174-efd6-4f84-949d-6ec263a707dd","year":2025},"citing_paper":{"arxiv_id":"2604.19157","last_updated":"2026-04-21T07:12:23Z","snapshot_observed_at":"2026-08-14T08:48:10.877440Z","submitted_at":"2026-04-21T07:12:23Z","title":"SAW-INT4: System-Aware 4-Bit KV-Cache Quantization for Real-World LLM Serving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T03:09:51.453839Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2604.19157"},"observation_digest":"sha256:d68b4c83c8c1be4c26f6acbcc433d41c61ac463351212b476a0b70be42080b09","observation_id":"b2271486-0af3-487c-b0b0-404416548090","resolution":{"observed_at":"2026-05-10T03:14:08.310691Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2506.18879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-07-02T22:57:26.279666Z","title":"Li, J., Zhang, Y ., Hassan, M","venue":null,"work_id":"32b03174-efd6-4f84-949d-6ec263a707dd","year":2025},"citing_paper":{"arxiv_id":"2605.24144","last_updated":"2026-05-22T19:06:22Z","snapshot_observed_at":"2026-08-18T23:05:06.423504Z","submitted_at":"2026-05-22T19:06:22Z","title":"EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T14:35:02.484377Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2605.24144"},"observation_digest":"sha256:e40b820d3ae0680afe3a3b53d0a46f2b534447d5592321377c8c8cd2c7cf0532","observation_id":"a9c3e704-b1b5-4523-9399-0a99bbd6c1b4","resolution":{"observed_at":"2026-06-30T14:44:45.580150Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":"2506.18879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-07-02T22:57:26.279666Z","title":"Li, J., Zhang, Y ., Hassan, M","venue":null,"work_id":"32b03174-efd6-4f84-949d-6ec263a707dd","year":2025},"citing_paper":{"arxiv_id":"2606.08382","last_updated":"2026-06-07T00:24:02Z","snapshot_observed_at":"2026-08-18T15:18:09.430726Z","submitted_at":"2026-06-07T00:24:02Z","title":"STAR-KV: Low-Rank KV Cache Compression via Soft Thresholding for Adaptive Rank Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T18:34:20.645677Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2606.08382"},"observation_digest":"sha256:f22dc39397a08a0fec3a325bb09e65e8c86c56438638923ec5fbb1409874374f","observation_id":"6a04cad5-0cca-4480-9555-201c7495f323","resolution":{"observed_at":"2026-07-02T22:57:26.281085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-08-01T17:16:38.209120Z","title":"arXiv preprint arXiv:2506.18879(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17715","last_updated":"2026-07-20T09:09:23Z","snapshot_observed_at":"2026-08-06T08:28:52.422763Z","submitted_at":"2026-07-20T09:09:23Z","title":"C$^2$KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T17:16:38.209120Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2607.17715"},"observation_digest":"sha256:ac8a8a0820d9ba38ecd62f5a39bc4a31ae69441f9967fd7d23cee612c7423244","observation_id":"96fdaf1c-f2fb-4cec-adb7-d8c04a040b56","resolution":{"observed_at":"2026-08-01T17:16:38.209120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-08-03T00:43:50.064347Z","title":"CommVQ: Commutative vector quantization for KV cache compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28699","last_updated":"2026-08-16T15:41:57Z","snapshot_observed_at":"2026-08-20T05:13:00.696194Z","submitted_at":"2026-07-30T11:04:45Z","title":"WitCert: Sound Runtime Risk Observability and Gating for KV-Cache Quantization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T00:43:50.064347Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2607.28699"},"observation_digest":"sha256:889bc6050b53034f3a745b1bf110d987e91c71a89a02cddae2a312a46665c6c2","observation_id":"b218b01b-f5a8-4ec9-bc57-da5b4c7cf1d5","resolution":{"observed_at":"2026-08-03T00:43:50.064347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-08-15T14:54:14.045740Z","title":"Commvq: Commutative vector quantization for kv cache compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04074","last_updated":"2026-08-04T16:10:59Z","snapshot_observed_at":"2026-08-18T14:05:50.337129Z","submitted_at":"2026-08-04T16:10:59Z","title":"Spend Bits Where Queries Look: KV Cache Vector Quantization with Attention-Preserving Transforms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:54:14.045740Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2608.04074"},"observation_digest":"sha256:8610d3b5d608950bf7bce72d868d5d3c7b69ec0fc6199082df5ae5b077d63743","observation_id":"8e17b076-902a-442c-9477-b77ee178bbda","resolution":{"observed_at":"2026-08-15T14:54:14.045740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18879","snapshot_observed_at":"2026-08-14T12:54:26.530296Z","title":"CommVQ : Commutative vector quantization for KV cache compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13365","last_updated":"2026-08-13T15:31:01Z","snapshot_observed_at":"2026-08-17T17:08:33.314163Z","submitted_at":"2026-08-13T15:31:01Z","title":"When Local Variance Optimality Is Not Enough: RoPE-Aligned Q/K Rotations for Dynamic 4-Bit Quantisation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T12:54:26.530296Z"},"links":{"cited_paper":"/paper/2506.18879","citing_paper":"/paper/2608.13365"},"observation_digest":"sha256:9a50004efba38e7930aea0e6c5f095f00cf9659e20fd4076da9ef27387429fb8","observation_id":"3b5d9bf4-acf6-4453-bb33-331adf66bcd4","resolution":{"observed_at":"2026-08-14T12:54:26.530296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.18879/citation-record","integrity":"/paper/2506.18879/integrity","json":"/paper/2506.18879/citation-record.json","paper":"/paper/2506.18879"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-15T03:05:41.956181Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-15T18:49:24.080945Z","title":"Categorical repa- rameterization with gumbel-softmax","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.080945Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:e80e8265c5ce92309ac62957545200dcb060af8f0fc46797897e766c47637cb7","observation_id":"5b18c4fc-0c2f-4622-a726-81a34f765043","resolution":{"observed_at":"2026-08-15T18:49:24.080945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:49:24.722150Z","title":"We calculate the codebook size based on LLaMA-3.1-8B-Instruct model","venue":null,"work_id":"f8b08af7-90d9-496b-a6cf-3b540037bb8c","year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.152304Z"},"links":{"citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:34bb558330b4091c0cef601ce4c0a93ab4955d8f72cc0c48125a311df2d27e42","observation_id":"48bb35fc-d9c9-48e9-b944-3af0ca493d08","resolution":{"observed_at":"2026-08-15T18:49:24.727617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15704","last_updated":"2024-10-21T07:20:41Z","snapshot_observed_at":"2026-08-17T21:04:17.014987Z","submitted_at":"2024-10-21T07:20:41Z","title":"Residual vector quantization for KV cache compression in large language model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15704","snapshot_observed_at":"2026-08-15T18:49:24.098559Z","title":"Residual vector quantization for kv cache compression in large language model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.098559Z"},"links":{"cited_paper":"/paper/2410.15704","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:e02e4b92b531be8de9d9d27161a73e96c0fb799f45f452602aef8c1e26d8cc12","observation_id":"b7e75f07-be45-4b0d-846a-5363ee659409","resolution":{"observed_at":"2026-08-15T18:49:24.098559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:49:24.103731Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.103731Z"},"links":{"citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:8a7f5de50e338e2d495ba3f439677f7fdcbf8d9d2837f0064c603f0add1d3dbc","observation_id":"80dd43e2-f99f-4afb-a5f6-826162e403e7","resolution":{"observed_at":"2026-08-15T18:49:24.103731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:49:24.684537Z","title":"The MSE is evaluated on a small subset of the FineWeb-Edu dataset (Lozhkov et al., 2024)","venue":null,"work_id":"b10b8f6f-a7f7-4a26-8a79-00f0356046a5","year":2024},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.164784Z"},"links":{"citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:1af193ff39bdca8a3130fd3a82b5d598e08ce0343e297fdea15df62229f6743c","observation_id":"26ac9b3f-8c7d-44fa-a441-d8bdc8ef82f1","resolution":{"observed_at":"2026-08-15T18:49:24.691393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-08-16T13:31:06.995791Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-15T18:49:24.114689Z","title":"Shi, L., Zhang, H., Yao, Y ., Li, Z., and Zhao, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.114689Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:f3d887a65f9e9f0dfbd8e46190e1970ff258caeb1fd50c33055f36ccf55cfbb9","observation_id":"93a778ed-c57c-4e7a-ad1c-0000ebe9a475","resolution":{"observed_at":"2026-08-15T18:49:24.114689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T18:49:24.121353Z","title":"Llama 2: Open foundation and fine- tuned chat models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.121353Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:dbc9c08b00362fd685aa4535a5064817db40269caa32e7ed265474b76360fde2","observation_id":"15f6826f-8272-447e-a03c-6f8e46aabf91","resolution":{"observed_at":"2026-08-15T18:49:24.121353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T18:49:24.133333Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.133333Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:363fdd9da7e3d46852ea45a19abd702f4781d208dca576b5c547bd00b116c583","observation_id":"3c0e767b-8816-47d0-b0f4-7ad702fe31be","resolution":{"observed_at":"2026-08-15T18:49:24.133333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01527","last_updated":"2024-10-08T19:34:03Z","snapshot_observed_at":"2026-08-16T13:38:01.315351Z","submitted_at":"2024-07-01T17:59:47Z","title":"KV Cache Compression, But What Must We Give in Return? A Comprehensive Benchmark of Long Context Capable Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01527","snapshot_observed_at":"2026-08-15T18:49:24.139988Z","title":"Kv cache compression, but what must we give in return? a compre- hensive benchmark of long context capable approaches","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.139988Z"},"links":{"cited_paper":"/paper/2407.01527","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:5f2c74fcb172831a1493981e7743a482781159d3f1d18049989dcdcab142ccc7","observation_id":"361296f1-a515-4717-a4d0-4c83f08c7bc0","resolution":{"observed_at":"2026-08-15T18:49:24.139988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03917","last_updated":"2024-05-07T00:25:20Z","snapshot_observed_at":"2026-08-16T13:54:52.224597Z","submitted_at":"2024-05-07T00:25:20Z","title":"KV Cache is 1 Bit Per Channel: Efficient Large Language Model Inference with Coupled Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03917","snapshot_observed_at":"2026-08-15T18:49:24.145639Z","title":"Kv cache is 1 bit per channel: Efficient large language model inference with coupled quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.145639Z"},"links":{"cited_paper":"/paper/2405.03917","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:bf680935d40d828b4b8e0fa065b314d047053d5d18a2c17e5620d5244faceedf","observation_id":"d50bfacd-1de6-423b-801d-20c0c0420fe7","resolution":{"observed_at":"2026-08-15T18:49:24.145639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:49:24.704670Z","title":null,"venue":null,"work_id":"3ea9f991-0092-4d92-a491-c215a84df1f6","year":2011},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.159283Z"},"links":{"citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:cdd8733bdd44de9e93ef29e817d736f2f12f03b8ffe1d7530120d84be724d2de","observation_id":"18f02273-0b23-4e18-b4de-5abc9912a1b5","resolution":{"observed_at":"2026-08-15T18:49:24.710831Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18079","last_updated":"2025-05-28T18:58:29Z","snapshot_observed_at":"2026-08-20T02:16:11.463896Z","submitted_at":"2024-01-31T18:58:14Z","title":"KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18079","snapshot_observed_at":"2026-08-15T18:49:24.074952Z","title":"W., Shao, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":1984,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.074952Z"},"links":{"cited_paper":"/paper/2401.18079","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:447ad88e77da2717ab21d6f0529d67ec1c280fe27b1a492cf2c1c57426f1f4ec","observation_id":"2baeb153-49e3-4b37-908b-b498371ecb17","resolution":{"observed_at":"2026-08-15T18:49:24.074952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T18:49:24.057637Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.057637Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:4ebdab10d6164f8fcac959a6c5c33632c3d8735022ceccfe39d6aa8ed3366593","observation_id":"8352d7d2-fe78-45cd-8d46-28f321f67305","resolution":{"observed_at":"2026-08-15T18:49:24.057637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-08-12T17:03:50.984887Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-15T18:49:24.109429Z","title":"Liu, Z., Desai, A., Liao, F., Wang, W., Xie, V ., Xu, Z., Kyril- lidis, A., and Shrivastava, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.109429Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:7d71840a5c7b4950bbe4c2a63bd2e81702ad133e3c17375420b5ca204fe5ae03","observation_id":"9548ebe1-9d30-4043-9d94-17531f1a2ea7","resolution":{"observed_at":"2026-08-15T18:49:24.109429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T18:49:24.086931Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.086931Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:f004753af4226a2b6fb59da4e0dc301882455fb7752a207772e3d8233183ee6b","observation_id":"6cec6971-1476-4399-82f1-8bd5e94784c0","resolution":{"observed_at":"2026-08-15T18:49:24.086931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-15T18:49:24.050006Z","title":"Longbench: A bilingual, multitask benchmark for long context under- standing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.050006Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:9abb5f889bfb5d047ee05a9ab4d22c0d2162708fe525deb9c2441624e61d0d3d","observation_id":"c2cfbc77-1ff0-4008-90f5-5a76d93442ce","resolution":{"observed_at":"2026-08-15T18:49:24.050006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-15T18:49:24.063087Z","title":"L., Zhang, C., Xu, Y ., Shang, N., Xu, J., Yang, F., and Yang, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.063087Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:eaac21e9076de04cc57345dbfd6b14a1cf3829bcb3c4b97c02d2aa6c838cdb8c","observation_id":"8d097a56-f1c6-4501-be3a-ecd5698b98ed","resolution":{"observed_at":"2026-08-15T18:49:24.063087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10819","last_updated":"2024-10-14T17:59:58Z","snapshot_observed_at":"2026-08-16T03:51:26.346422Z","submitted_at":"2024-10-14T17:59:58Z","title":"DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10819","snapshot_observed_at":"2026-08-15T18:49:24.127218Z","title":"Duoattention: Efficient long-context llm inference with retrieval and streaming heads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.127218Z"},"links":{"cited_paper":"/paper/2410.10819","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:08e9bf61a98ff31013f9fea64fab77e24f9b3dd0ae15d5a0b5305b07982db172","observation_id":"16f230de-5f9e-4ad8-8d97-b83fc7f1ba81","resolution":{"observed_at":"2026-08-15T18:49:24.127218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01325","last_updated":"2024-07-11T06:11:46Z","snapshot_observed_at":"2026-08-16T14:30:16.010730Z","submitted_at":"2024-01-02T18:30:51Z","title":"LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01325","snapshot_observed_at":"2026-08-15T18:49:24.092793Z","title":"Llm maybe longlm: Self- extend llm context window without tuning.arXiv preprint arXiv:2401.01325,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.092793Z"},"links":{"cited_paper":"/paper/2401.01325","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:e1fd45117783af437be06d218a12e992c9cc20a99655626992e92ff6effb9cbd","observation_id":"b960514f-b1aa-4abf-b6eb-716655140933","resolution":{"observed_at":"2026-08-15T18:49:24.092793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T18:49:24.068972Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T18:49:24.068972Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.18879"},"observation_digest":"sha256:c22c8d8db9ec71f80659d3c43db3d40eac2057758ab6ca9f2c778de8576d31da","observation_id":"830942ce-3018-40fe-bfde-9532c3878087","resolution":{"observed_at":"2026-08-15T18:49:24.068972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18879","last_updated":"2025-06-23T17:50:11Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T01:51:29.045572Z","submitted_at":"2025-06-23T17:50:11Z","title":"CommVQ: Commutative Vector Quantization for KV Cache Compression"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 9 inbound Pith citation observations for arXiv:2506.18879."}