{"as_of":"2026-08-14T23:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5791965fc58963104264ee24520cd76d32dd1f32201ca783f77c01f312f6781","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:13:55.342435Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T20:15:58.175553Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-12T12:13:55.342435Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.17426","last_updated":"2025-01-31T14:13:49Z","snapshot_observed_at":"2026-08-14T13:04:05.017929Z","submitted_at":"2024-11-26T13:34:02Z","title":"CLOVER: Cross-Layer Orthogonal Vectors Pruning and Fine-Tuning","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T12:13:55.342435Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2411.17426"},"observation_digest":"sha256:1db07a8ded9dbf044377da6736650eff497e91195fb665995801749d30fe8d15","observation_id":"b3ed83cb-0398-441a-9e59-5dc460e7eb44","resolution":{"observed_at":"2026-08-12T12:13:55.342435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-11T13:52:48.840582Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12706","last_updated":"2025-02-20T12:14:49Z","snapshot_observed_at":"2026-08-13T11:09:26.001382Z","submitted_at":"2024-12-17T09:20:31Z","title":"More Tokens, Lower Precision: Towards the Optimal Token-Precision Trade-off in KV Cache Compression","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T13:52:48.840582Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2412.12706"},"observation_digest":"sha256:c20d0316dfc6ebcc6b5d99b15fb065eea34d670c63d4936fcd4fbe5f91b6b190","observation_id":"379f3c06-11b5-4a3f-8aa5-1a0921f3d02b","resolution":{"observed_at":"2026-08-11T13:52:48.840582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-11T00:55:04.049741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19255","last_updated":"2025-01-14T05:48:07Z","snapshot_observed_at":"2026-08-14T11:12:42.419587Z","submitted_at":"2024-12-26T15:45:45Z","title":"Multi-matrix Factorization Attention","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:55:04.049741Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2412.19255"},"observation_digest":"sha256:1552562dfca172218ea07c563718bd452fbcbb3d7b5e6489617922c2abcba9a2","observation_id":"f6a75ec7-d879-4c79-ab6d-85c446259519","resolution":{"observed_at":"2026-08-11T00:55:04.049741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-11T00:38:48.826304Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-11T00:33:34.388194Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"reference_index":200,"source":"pdf_text","source_observed_at":"2026-08-11T00:38:48.826304Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2412.19442"},"observation_digest":"sha256:0fc5959ffc49d0fa86b29a9ba25bf199f7beb9a97dbcaed70b69c5c7fdd9c1e9","observation_id":"e4a93f0a-d1ba-443e-afbe-23691d6d1013","resolution":{"observed_at":"2026-08-11T00:38:48.826304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-08T11:48:01.208529Z","title":"Mlkv: Multi-layer key-value heads for memory efficient transformer decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07864","last_updated":"2025-06-12T11:45:57Z","snapshot_observed_at":"2026-08-10T11:58:20.177769Z","submitted_at":"2025-02-11T18:20:18Z","title":"TransMLA: Multi-Head Latent Attention Is All You Need","version":5},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T11:48:01.208529Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2502.07864"},"observation_digest":"sha256:9cf0c21f601e9baa8513e0db7b6706ee7bc57ca69dfd07257b8e7bcfd1b57e62","observation_id":"8c54e9f0-2323-4fed-adcd-d76970a55959","resolution":{"observed_at":"2026-08-08T11:48:01.208529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":"2406.09297","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-05T20:15:58.175553Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","venue":"cs.LG","work_id":"5d118178-048e-43eb-82d8-fb845e10f717","year":2024},"citing_paper":{"arxiv_id":"2508.10824","last_updated":"2025-08-16T03:17:35Z","snapshot_observed_at":"2026-08-09T19:21:50.118383Z","submitted_at":"2025-08-14T16:48:38Z","title":"Memory-Augmented Transformers: A Systematic Review from Neuroscience Principles to Enhanced Model Architectures","version":2},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-08-05T20:15:57.782754Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2508.10824"},"observation_digest":"sha256:3c1850b698f6017bd80a9a1f8628619fa9337dd7f4a3775d5529ece52225ab89","observation_id":"baf7dfb4-9da4-476f-9c9b-318038147008","resolution":{"observed_at":"2026-08-05T20:15:58.298505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09297","snapshot_observed_at":"2026-08-02T09:51:03.347596Z","title":"arXiv preprint arXiv:2406.09297 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16252","last_updated":"2026-06-27T03:25:36Z","snapshot_observed_at":"2026-08-08T02:31:05.095460Z","submitted_at":"2026-06-27T03:25:36Z","title":"SOS-LoRA: Static Orthogonal-Subspace Low-Rank Adaptation with Fixed Multi-Scale Scaling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T09:51:03.347596Z"},"links":{"cited_paper":"/paper/2406.09297","citing_paper":"/paper/2607.16252"},"observation_digest":"sha256:6354b5c1e854ec3aa5be2fa09a3a64ba082232c706f8d5555d162d98c3672f9a","observation_id":"b9024bee-7640-4399-b436-2a17ca8b25cd","resolution":{"observed_at":"2026-08-02T09:51:03.347596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.09297/citation-record","integrity":"/paper/2406.09297/integrity","json":"/paper/2406.09297/citation-record.json","paper":"/paper/2406.09297"},"outbound":[],"paper":{"arxiv_id":"2406.09297","last_updated":"2024-10-15T08:45:18Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T18:24:43.362246Z","submitted_at":"2024-06-13T16:33:44Z","title":"MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2406.09297."}