{"as_of":"2026-08-08T13:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26f5fafbb2f15e331656b189767bccb8a304510a5d2981373d26ccfa39255cfc","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:10:01.390805Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06517/citation-record","integrity":"/paper/2507.06517/integrity","json":"/paper/2507.06517/citation-record.json","paper":"/paper/2507.06517"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.141523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.141523Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:5ebe83883512dbcadd0bab6e171051a399c3efed614e5a05829e61664b108348","observation_id":"2f23e687-b51d-4007-9a7d-c401816796f0","resolution":{"observed_at":"2026-08-06T19:10:01.141523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.149847Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.149847Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:0f60ae41ed776a8f621aca92bfb87f0c842774d6b99a2491c29d9378f11506e8","observation_id":"dd74c056-2c14-4c44-8a9b-ab95831d2caf","resolution":{"observed_at":"2026-08-06T19:10:01.149847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.159355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.159355Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ea512b7f60f5282b13cb88d43f6f3b2b1385140d160cddd7ae710c5de65e7766","observation_id":"d2058252-854e-40fc-83a4-e0e736a0a99c","resolution":{"observed_at":"2026-08-06T19:10:01.159355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T19:10:01.168058Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.168058Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:44f56b7f1556ae43d4d9b103af723ccf4b89170755c0303b90d97a3540dd143c","observation_id":"909506b7-faec-4605-9ec8-43fbedf0c25a","resolution":{"observed_at":"2026-08-06T19:10:01.168058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T19:10:01.174335Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.174335Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:e3b5ee7fdc408e1e1d3b16c71f157a4c6dba9f7766fa647bd09a09d886b9341e","observation_id":"0948fccb-6ff9-4cde-894b-3291a937a64e","resolution":{"observed_at":"2026-08-06T19:10:01.174335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-06T19:10:01.179964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.179964Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:580a4294174b0d828c81adc343dacfb6ead363fb0b50160a0495d66b282cf614","observation_id":"18d9c572-7fdc-4e8b-bcc0-0d3fa60daa9b","resolution":{"observed_at":"2026-08-06T19:10:01.179964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T19:10:01.187348Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.187348Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:29c2623ad5e782a1743ef8358946367fcc80264b6e870d59e631c0d3a917c7a2","observation_id":"f927478e-2834-44c1-a324-84b6c04986a9","resolution":{"observed_at":"2026-08-06T19:10:01.187348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.195409Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.195409Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:46f5daeec0dfe5675e1abd316685bca3693cab7434acb5c0217a63ec2750675e","observation_id":"a9a09754-ce12-4f78-a4eb-768cfbd703a5","resolution":{"observed_at":"2026-08-06T19:10:01.195409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-07T22:57:56.263839Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-06T19:10:01.203208Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.203208Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:b87c28af133757d2322e159a5d8042178560ee4ffb5556aafa17050e0d513fa9","observation_id":"cfa7e96e-266d-4d86-a1be-924418abc8ab","resolution":{"observed_at":"2026-08-06T19:10:01.203208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14366","last_updated":"2024-09-07T02:52:29Z","snapshot_observed_at":"2026-08-04T12:08:53.387357Z","submitted_at":"2024-05-23T09:43:52Z","title":"MiniCache: KV Cache Compression in Depth Dimension for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14366","snapshot_observed_at":"2026-08-06T19:10:01.211946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.211946Z"},"links":{"cited_paper":"/paper/2405.14366","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:37f4a5e8bf1faa44e810fbf77306bab5ea3b0f7594c066e3b1a67fde5377d7de","observation_id":"338b3950-8251-4c0f-99be-28abbd3377f5","resolution":{"observed_at":"2026-08-06T19:10:01.211946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.892306Z","title":null,"venue":null,"work_id":"1148b493-2162-4c67-8d66-877725b78872","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.219768Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:ba78b7d49728408f187770a242fa7bafe1819e2374e4b8a6adaee48c1afb320d","observation_id":"9fdba2e3-31ff-42f0-8175-5110e941edf5","resolution":{"observed_at":"2026-08-06T19:10:02.958339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23924","last_updated":"2025-03-31T10:16:03Z","snapshot_observed_at":"2026-08-08T03:24:25.330902Z","submitted_at":"2025-03-31T10:16:03Z","title":"Model Hemorrhage and the Robustness Limits of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23924","snapshot_observed_at":"2026-08-06T19:10:01.234102Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.234102Z"},"links":{"cited_paper":"/paper/2503.23924","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:8e93d8e41c2922915d5eb5525c085824eaa59d5b06859ce65b396df4b5dd6191","observation_id":"c95eb433-c79e-41b0-ad08-0d5889a4ebb0","resolution":{"observed_at":"2026-08-06T19:10:01.234102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T19:10:01.240080Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.240080Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:757785af268bd80839887ab0253f8a80598e906513426fbb5265a20f45eaf9cd","observation_id":"d6de484d-3952-42d4-bd55-90adf7f0a6a8","resolution":{"observed_at":"2026-08-06T19:10:01.240080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-06T19:10:01.245546Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.245546Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:03d261d988760ca8af063bb12504a61c7d5d15762133ac955919ebd699e9cc8b","observation_id":"cedb03dc-0ed5-417f-b6fe-93a3f06cca24","resolution":{"observed_at":"2026-08-06T19:10:01.245546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-06T19:10:01.252625Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.252625Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:0a92fb9f042ae793ffc23eba8b6a4f242246e12a53d164c46646a3cea47a34be","observation_id":"5d68095d-1839-48b6-bb9b-f6b7f9013ff1","resolution":{"observed_at":"2026-08-06T19:10:01.252625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.736366Z","title":null,"venue":null,"work_id":"7d877cad-5684-4d89-9bf9-cc267cac0486","year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.259075Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:99e0ea4931901b4360833ec4c1547f4212bcd9c1bd407f33d0e883a4bf2ce338","observation_id":"66924c83-215c-41d0-b708-5ffa2f2154c6","resolution":{"observed_at":"2026-08-06T19:10:02.815580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.595278Z","title":null,"venue":null,"work_id":"33720ba9-83c2-4423-a27f-71efe2250551","year":2025},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.266524Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:8ac7d43a0924586bc8ca32a6a439d555332c9ddb3af83abd3237758ca3b80893","observation_id":"3052772c-d3e2-4298-a07d-dbd0d9d2fce4","resolution":{"observed_at":"2026-08-06T19:10:02.657536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-07-06T18:51:49.871551Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-06T19:10:01.272177Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.272177Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:8ceeb492b0051d36058191f6535916979a11d1ce40d6a4c72e5b1e481ce058b7","observation_id":"34f513a7-45ee-4117-9607-8b2ff82b929e","resolution":{"observed_at":"2026-08-06T19:10:01.272177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13212","last_updated":"2024-10-17T04:35:57Z","snapshot_observed_at":"2026-08-04T15:23:36.502507Z","submitted_at":"2024-10-17T04:35:57Z","title":"AsymKV: Enabling 1-Bit Quantization of KV Cache with Layer-Wise Asymmetric Quantization Configurations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13212","snapshot_observed_at":"2026-08-06T19:10:01.279099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.279099Z"},"links":{"cited_paper":"/paper/2410.13212","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:1ac75d83947b6bedf821c3e061c09a420387a89c0fb870f479ed3a25aaa38df9","observation_id":"a16d05fe-7f1f-41ff-bfe8-b04508726fb9","resolution":{"observed_at":"2026-08-06T19:10:01.279099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T19:10:01.285988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.285988Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:fe983a973316e37e746c5d23e1604da81c2f3c868ca76fe74e757f0f3afefb23","observation_id":"a5583f0b-12c2-4186-8b24-9606c559e13f","resolution":{"observed_at":"2026-08-06T19:10:01.285988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13035","last_updated":"2025-03-13T03:16:43Z","snapshot_observed_at":"2026-08-05T10:25:57.608223Z","submitted_at":"2024-06-18T20:01:51Z","title":"D2O: Dynamic Discriminative Operations for Efficient Long-Context Inference of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13035","snapshot_observed_at":"2026-08-06T19:10:01.293262Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.293262Z"},"links":{"cited_paper":"/paper/2406.13035","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:1066e01e4ec60ddd7427cbdae0431446bdc235deeb53eefc0c30c699c4316ed2","observation_id":"e7596169-23e7-4742-955b-2e4a21a5c4fa","resolution":{"observed_at":"2026-08-06T19:10:01.293262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08454","last_updated":"2024-07-21T02:37:11Z","snapshot_observed_at":"2026-07-06T18:44:49.512236Z","submitted_at":"2024-07-11T12:50:42Z","title":"Model Tells You Where to Merge: Adaptive KV Cache Merging for LLMs on Long-Context Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08454","snapshot_observed_at":"2026-08-06T19:10:01.298502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.298502Z"},"links":{"cited_paper":"/paper/2407.08454","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:28b9f36829018e507122a754f1feaf60226a7b777e154984fa2e315416a6b4df","observation_id":"dd288fb9-7a4b-4fb8-b39a-a5dab284f6bb","resolution":{"observed_at":"2026-08-06T19:10:01.298502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.304251Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.304251Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:5950e3faa4e55f062d9e0b40d935b8cc1ddf17d46bbd427f4eb1a7a3ad953c0a","observation_id":"12ddd718-c7ce-4e1d-aa7f-fba1157d9910","resolution":{"observed_at":"2026-08-06T19:10:01.304251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.311005Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.311005Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:fd9169c38ca44f9e90d2e26c6868243aeb13b6df6049dcef588b73de1f10bae6","observation_id":"598a83f7-34fb-43d5-9443-2987dcd35c1d","resolution":{"observed_at":"2026-08-06T19:10:01.311005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.316923Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.316923Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:e29ddd4dc659c79384d849e1558aa3c1372ab4c9de0f4e516b84dd110025e5f9","observation_id":"ac18d532-b1fb-41e0-bca9-3365bec40329","resolution":{"observed_at":"2026-08-06T19:10:01.316923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T19:10:01.321670Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.321670Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a7b7a3960dcd4dc53665795d10133814eeef2d1c13b7b0951847d7302d274846","observation_id":"62fb2d66-e718-45ca-931f-b3977f2d1a89","resolution":{"observed_at":"2026-08-06T19:10:01.321670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.327165Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.327165Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:29a81993deb78bce49fbccc3a3a819483858128170ad275cfcba61ea7551bcc4","observation_id":"cc068d4b-028d-4e40-aeb8-fa23a8cb2e7f","resolution":{"observed_at":"2026-08-06T19:10:01.327165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-07-06T17:36:40.933805Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-06T19:10:01.332282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.332282Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:46a77873eaf6d89cd46e9e73aa845049fa0d5553d26544f52bab6b6d02ba22b0","observation_id":"e3b232ec-8ee1-41d4-bc37-ec79c6e23609","resolution":{"observed_at":"2026-08-06T19:10:01.332282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10285","last_updated":"2024-08-19T05:17:40Z","snapshot_observed_at":"2026-08-08T11:10:38.862068Z","submitted_at":"2024-08-19T05:17:40Z","title":"BatGPT-Chem: A Foundation Large Model For Retrosynthesis Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10285","snapshot_observed_at":"2026-08-06T19:10:01.337858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.337858Z"},"links":{"cited_paper":"/paper/2408.10285","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:4da3a21f795a1d3393de2a61b033e3f7f000e351a8a72c869be0bcff0477fa61","observation_id":"8b3b2c85-1c67-4692-8799-445c095d568e","resolution":{"observed_at":"2026-08-06T19:10:01.337858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.204","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.494392Z","title":null,"venue":null,"work_id":"cad586a6-0149-44bd-be2a-2164afcd330b","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.342595Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:0decb768cf4983654c102f76cc5cf270a09ae9c08793e3cd4f5b0cce5429020e","observation_id":"07873f95-ec27-4261-9456-7458ae1c2872","resolution":{"observed_at":"2026-08-06T19:10:01.502841Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.347645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.347645Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:924fc74d5271b434582a9e0e6c75f525dc2a641c3a14e4ae1557f749855238ca","observation_id":"c0dc3682-d4ee-42ea-bc80-c6e869a2ab90","resolution":{"observed_at":"2026-08-06T19:10:01.347645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.143","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.454394Z","title":null,"venue":null,"work_id":"a3944fea-3704-4d73-b13e-1c40717cee11","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.352699Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a02d7491bde3e85b7daa9ed338994850beb02a78df021bf4b117a41b29263745","observation_id":"27186367-5797-4737-961a-b045ba22433b","resolution":{"observed_at":"2026-08-06T19:10:01.461578Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.359336Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.359336Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:25fed6f9f726cfac208d205b27bf06304c59f8c82283b1d4486da14287944946","observation_id":"a4760a97-6ed4-440c-a581-008cf9b4c222","resolution":{"observed_at":"2026-08-06T19:10:01.359336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T19:10:01.365544Z","title":"Diab, Xian Li, Xi Victoria Lin, Todor Mihaylov, Myle Ott, Sam Shleifer, Kurt Shuster, Daniel Simig, Punit Singh Koura, Anjali Sridhar, Tianlu Wang, and Luke Zettlemoyer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.365544Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a6dbe2c62d7154af47bfe419b5c019f938e769729d7c9fce658abc238d522f61","observation_id":"881219f6-dd4c-46bd-bba7-279f8ef78d02","resolution":{"observed_at":"2026-08-06T19:10:01.365544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:02.372580Z","title":null,"venue":null,"work_id":"255b07d2-5d72-4644-b583-c70017991b59","year":2024},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.371495Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:bd2e433cc78dd98ef13ecf377764fdc354232c2fe318cbfd4d88bde5b41823d9","observation_id":"6fb9500a-4b9b-43bd-b9e4-c8d4a40a5711","resolution":{"observed_at":"2026-08-06T19:10:02.464695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.377937Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.377937Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:83fbe0c32f6187a832ed6bdc514822740b1dad8e46f3b5daad5cbee588a78810","observation_id":"2a58ea80-198c-4d79-91a5-87f34443b4d2","resolution":{"observed_at":"2026-08-06T19:10:01.377937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.384792Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.384792Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:e86eb87e48a3a1774b5d7c870a5a0563845f124a1d485bdf615400d08d7de991","observation_id":"17425d81-1528-4a3d-b696-ece85a124c6f","resolution":{"observed_at":"2026-08-06T19:10:01.384792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:10:01.390805Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T19:10:01.390805Z"},"links":{"citing_paper":"/paper/2507.06517"},"observation_digest":"sha256:a50b01f8370eee947710c730f4291bb504969ff4343d1144205d2b8386181497","observation_id":"97ec6cba-9c59-477b-9854-08077b409f24","resolution":{"observed_at":"2026-08-06T19:10:01.390805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06517","last_updated":"2025-07-09T03:33:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:11:26.897820Z","submitted_at":"2025-07-09T03:33:44Z","title":"SpindleKV: A Novel KV Cache Reduction Method Balancing Both Shallow and Deep Layers"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.06517."}