{"as_of":"2026-08-14T02:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48426a3ad5570897017c8d06f350dd39f6a8936dd4a8bd8bd5ce25d413349256","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:46:51.523721Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T16:27:09.089504Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14820","snapshot_observed_at":"2026-08-06T18:46:51.523721Z","title":"How smooth is attention? arXiv preprint arXiv:2312.14820, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07814","last_updated":"2025-07-10T14:45:31Z","snapshot_observed_at":"2026-08-13T21:49:02.223547Z","submitted_at":"2025-07-10T14:45:31Z","title":"Pay Attention to Attention Distribution: A New Local Lipschitz Bound for Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:46:51.523721Z"},"links":{"cited_paper":"/paper/2312.14820","citing_paper":"/paper/2507.07814"},"observation_digest":"sha256:62084c4439ee5469da5344ed302248a0c7d0bc6603b8e27ba9be2ba4fc4b0bc6","observation_id":"2e35bfe4-9551-431f-afd1-6be179ed9eb5","resolution":{"observed_at":"2026-08-06T18:46:51.523721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14820","snapshot_observed_at":"2026-08-05T13:55:34.581643Z","title":"How smooth is attention? In ICML, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00421","last_updated":"2025-08-30T09:08:00Z","snapshot_observed_at":"2026-08-11T03:33:14.501107Z","submitted_at":"2025-08-30T09:08:00Z","title":"Memory Limitations of Prompt Tuning in Transformers","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T13:55:34.581643Z"},"links":{"cited_paper":"/paper/2312.14820","citing_paper":"/paper/2509.00421"},"observation_digest":"sha256:a16468c5b26765c7d23fd2aa51e3432469534d07457a35270d1be93089a35252","observation_id":"1aff418a-db5e-494e-8d9b-aa07aad35ff0","resolution":{"observed_at":"2026-08-05T13:55:34.581643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?","version":2},"cited_work":{"arxiv_id":"2312.14820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14820","snapshot_observed_at":"2026-07-02T16:27:09.089504Z","title":"How Smooth Is Attention? arXiv preprint arXiv:2312.14820, 2023","venue":null,"work_id":"56e2f70c-1d3f-4837-b668-2ad1e02cfce7","year":2023},"citing_paper":{"arxiv_id":"2604.20858","last_updated":"2026-03-01T23:20:48Z","snapshot_observed_at":"2026-08-11T21:18:46.381745Z","submitted_at":"2026-03-01T23:20:48Z","title":"Mixture of Sequence: Theme-Aware Mixture-of-Experts for Long-Sequence Recommendation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T17:30:44.919870Z"},"links":{"cited_paper":"/paper/2312.14820","citing_paper":"/paper/2604.20858"},"observation_digest":"sha256:4e75a9ab3564338c630d7f20e719162de9cd0bd36d35b16e056743eb2b08e547","observation_id":"5161079d-d1c1-42d9-b06c-511f99ed4183","resolution":{"observed_at":"2026-05-15T17:31:22.273009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?","version":2},"cited_work":{"arxiv_id":"2312.14820","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.14820","snapshot_observed_at":"2026-07-02T16:27:09.089504Z","title":"How Smooth Is Attention? arXiv preprint arXiv:2312.14820, 2023","venue":null,"work_id":"56e2f70c-1d3f-4837-b668-2ad1e02cfce7","year":2023},"citing_paper":{"arxiv_id":"2606.07684","last_updated":"2026-06-05T02:46:04Z","snapshot_observed_at":"2026-08-08T05:48:50.883642Z","submitted_at":"2026-06-05T02:46:04Z","title":"Semantic Cache Distillation: Efficient State Transfer via Reuse and Selective Patching","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T22:43:25.637631Z"},"links":{"cited_paper":"/paper/2312.14820","citing_paper":"/paper/2606.07684"},"observation_digest":"sha256:a23b80cae418cc89409670c8b51366c966db3568e93f3002ea76493d0bf13872","observation_id":"34346875-7dfa-4f41-96d0-5e82faeda62f","resolution":{"observed_at":"2026-07-02T16:27:09.090837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.14820/citation-record","integrity":"/paper/2312.14820/integrity","json":"/paper/2312.14820/citation-record.json","paper":"/paper/2312.14820"},"outbound":[],"paper":{"arxiv_id":"2312.14820","last_updated":"2024-06-04T15:51:36Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T04:55:09.283448Z","submitted_at":"2023-12-22T16:47:10Z","title":"How Smooth Is Attention?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2312.14820."}