{"as_of":"2026-08-11T10:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23e3ade32d4bc4e0d7eb9e486c940ae993d56fc69a5fb60539fd0f2bda8aa749","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T23:22:32.056496Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15456/citation-record","integrity":"/paper/2607.15456/integrity","json":"/paper/2607.15456/citation-record.json","paper":"/paper/2607.15456"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T23:22:30.397930Z","title":"GQA: Training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:30.397930Z"},"links":{"citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:adcc31b55bc8827acb1de13aa6a89e7f22eb0e75dd189e3a722662cb80cc54f9","observation_id":"f209d013-055a-42de-910e-a9ccc06c6dd2","resolution":{"observed_at":"2026-08-01T23:22:30.397930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T23:22:32.056496Z","title":"The precision baseline cannot reach the largest ratios without collapse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:32.056496Z"},"links":{"citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:bb430349ba460c72e2b7ca3db3ecf118ddf98a326895edde692a477b37e10742","observation_id":"deea2628-b632-4963-9166-cd3aaaa8d1b1","resolution":{"observed_at":"2026-08-01T23:22:32.056496Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-01T23:22:31.282517Z","title":"Fast transformer decoding: One write-head is all you need.arXiv preprint arXiv:1911.02150,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.282517Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:93ee277e60962b8712cfbaeceef0d349b25cce55245a7f1c2ab44386df54552b","observation_id":"c8d1992b-01f9-420e-859b-a421862a3b67","resolution":{"observed_at":"2026-08-01T23:22:31.282517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-01T23:22:31.448925Z","title":"RoFormer: Enhanced transformer with rotary position embedding.arXiv preprint arXiv:2104.09864,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.448925Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:91eb25e7059fa565a704314ec15daa13d109b6a82689fb9859124046a4b0cf4c","observation_id":"9a5bd9ba-0748-4db5-ad3d-6190de13475b","resolution":{"observed_at":"2026-08-01T23:22:31.448925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.07721","snapshot_observed_at":"2026-08-01T23:22:31.783125Z","title":"Memory-efficient looped transformer: Decoupling compute from memory in looped language models.arXiv preprint arXiv:2605.07721,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.783125Z"},"links":{"cited_paper":"/paper/2605.07721","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:e8816905ca4f521f9f857e5dd896a95805d6c5492403a1ee371129ed5b4b7d0d","observation_id":"2e3029da-0566-4fe0-9ac5-5a4c8edb74b9","resolution":{"observed_at":"2026-08-01T23:22:31.783125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.25741","snapshot_observed_at":"2026-08-01T23:22:31.822685Z","title":"Scaling latent reasoning via looped language models.arXiv preprint arXiv:2510.25741,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.822685Z"},"links":{"cited_paper":"/paper/2510.25741","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:4c931a6981a98ea9b503d7c09864bd426980ad91485d11e84400e21febacf285","observation_id":"39ec6a33-488c-40fa-8478-a23de9a4ac15","resolution":{"observed_at":"2026-08-01T23:22:31.822685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T23:22:31.901786Z","title":null,"venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.901786Z"},"links":{"citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:367b7d5f0f21d367b9b29471d7afad02627600ff07dd3e9dbe9da0db39f6d4b8","observation_id":"5514fa0e-c77e-4487-bf68-30c432402a2f","resolution":{"observed_at":"2026-08-01T23:22:31.901786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-01T23:22:30.789143Z","title":"Bartoldson, Bhavya Kailkhura, Abhinav Bhatele, and Tom Goldstein","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:30.789143Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:63e6a88b8c2985f165b6281fbbd4d6811f3d90af8e232e0f96805990836008f3","observation_id":"44f54169-daf6-428e-94a0-ecc10c537f48","resolution":{"observed_at":"2026-08-01T23:22:30.789143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05254","last_updated":"2024-05-09T14:12:45Z","snapshot_observed_at":"2026-08-04T14:59:09.585356Z","submitted_at":"2024-05-08T17:57:39Z","title":"You Only Cache Once: Decoder-Decoder Architectures for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05254","snapshot_observed_at":"2026-08-01T23:22:31.614891Z","title":"You only cache once: Decoder-decoder architectures for language models.arXiv preprint arXiv:2405.05254,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.614891Z"},"links":{"cited_paper":"/paper/2405.05254","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:9d2d67697dafd93cf54448defa071d89ff5b6824a6855aa4c919d6b0fac51f95","observation_id":"2348b8b4-20be-4ce9-ac7f-1ae1c7839e96","resolution":{"observed_at":"2026-08-01T23:22:31.614891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14366","last_updated":"2024-09-07T02:52:29Z","snapshot_observed_at":"2026-08-04T12:08:53.387357Z","submitted_at":"2024-05-23T09:43:52Z","title":"MiniCache: KV Cache Compression in Depth Dimension for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14366","snapshot_observed_at":"2026-08-01T23:22:31.121825Z","title":"Minicache: Kv cache compression in depth dimension for large language models.arXiv preprint arXiv:2405.14366,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:31.121825Z"},"links":{"cited_paper":"/paper/2405.14366","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:f0d08cb6324a96563875a663fde57b2053c826425dd72672edf6f1c4437b67bb","observation_id":"9f43cf07-6576-47ee-b798-22ec9e9db6d5","resolution":{"observed_at":"2026-08-01T23:22:31.121825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-01T23:22:30.635042Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model.arXiv preprint arXiv:2405.04434,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:30.635042Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:4c30e46ff8a33090ab8e765681c316abd8a03e9caaf0dcfc5358d3abb12cd625","observation_id":"56c12b71-a98f-4f61-b13e-c553f0514438","resolution":{"observed_at":"2026-08-01T23:22:30.635042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18079","last_updated":"2025-05-28T18:58:29Z","snapshot_observed_at":"2026-08-09T08:05:16.511956Z","submitted_at":"2024-01-31T18:58:14Z","title":"KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18079","snapshot_observed_at":"2026-08-01T23:22:30.957456Z","title":"Kvquant: Towards 10 million context length llm inference with kv cache quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:30.957456Z"},"links":{"cited_paper":"/paper/2401.18079","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:26f8e98c63ed7a6edb8347b83b56ecdaa1d0d947940801b985ac4a3976759ebb","observation_id":"c399909b-00ee-449b-aa0e-cdb766908015","resolution":{"observed_at":"2026-08-01T23:22:30.957456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11791","last_updated":"2026-04-13T17:55:36Z","snapshot_observed_at":"2026-08-02T14:25:36.633868Z","submitted_at":"2026-04-13T17:55:36Z","title":"A Mechanistic Analysis of Looped Reasoning Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11791","snapshot_observed_at":"2026-08-01T23:22:30.480923Z","title":"William Brandon et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T23:22:30.480923Z"},"links":{"cited_paper":"/paper/2604.11791","citing_paper":"/paper/2607.15456"},"observation_digest":"sha256:9be137a679f8c3d4b43c85b12ab3c80c19af4aa5d8e22db8fc819f2e4f9851c6","observation_id":"6a53af8d-45c1-48bc-aad2-09f2e4f742d3","resolution":{"observed_at":"2026-08-01T23:22:30.480923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15456","last_updated":"2026-07-24T02:15:23Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T15:51:58.210107Z","submitted_at":"2026-07-16T20:58:16Z","title":"Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2607.15456."}