{"as_of":"2026-08-23T21:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b64aa3d8592a7ebd47da348482c73a1c514d44df748fca7def6496ade609e56","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T01:07:10.338919Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2410.10781","last_updated":"2025-03-02T14:37:53Z","snapshot_observed_at":"2026-08-17T16:25:55.906179Z","submitted_at":"2024-10-14T17:50:28Z","title":"When Attention Sink Emerges in Language Models: An Empirical View","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-16T17:41:03.674759Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2410.10781"},"observation_digest":"sha256:3c9323e2bf63a941d7cdb034f478ed0eeacca2135f951500e95d96e4e9d5a7ab","observation_id":"f38c3829-aa08-4079-a839-31f36f9f0574","resolution":{"observed_at":"2026-05-16T17:41:03.780096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-12T20:12:25.386894Z","title":"Unveiling and har- nessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-18T12:56:24.009168Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T20:12:25.386894Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2411.09968"},"observation_digest":"sha256:29d32420f9b1d25fddf606130aa7b0e6425c40171aad3204a2bb9c748264d06a","observation_id":"8dae5ba5-8f92-49ef-b141-71c705dc3706","resolution":{"observed_at":"2026-08-12T20:12:25.386894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-10T14:29:28.318562Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15269","last_updated":"2025-01-25T16:36:00Z","snapshot_observed_at":"2026-08-19T19:59:13.189477Z","submitted_at":"2025-01-25T16:36:00Z","title":"Mirage in the Eyes: Hallucination Attack on Multi-modal Large Language Models with Only Attention Sink","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-10T14:29:28.318562Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2501.15269"},"observation_digest":"sha256:a60a4ac867a42fbbe45ff5ef6c6b197b7147f3a67db807691d617129fe854c25","observation_id":"f379fb86-6723-4b09-8d16-9290b406a22e","resolution":{"observed_at":"2026-08-10T14:29:28.318562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-10T14:54:22.742657Z","title":"Un- veiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16383","last_updated":"2025-02-02T03:04:54Z","snapshot_observed_at":"2026-08-18T23:10:12.488042Z","submitted_at":"2025-01-25T01:45:29Z","title":"RotateKV: Accurate and Robust 2-Bit KV Cache Quantization for LLMs via Outlier-Aware Adaptive Rotations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:54:22.742657Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2501.16383"},"observation_digest":"sha256:ec0bd38ab650f8fcc91d43c9f109f3efd72645e5cff96d003ef242c533ce9577","observation_id":"18a42c33-689b-4027-9e27-082b3c1e12de","resolution":{"observed_at":"2026-08-10T14:54:22.742657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-16T01:07:10.338919Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.02130","last_updated":"2025-05-04T14:40:31Z","snapshot_observed_at":"2026-08-18T23:53:16.496710Z","submitted_at":"2025-05-04T14:40:31Z","title":"Attention Mechanisms Perspective: Exploring LLM Processing of Graph-Structured Data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T01:07:10.338919Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2505.02130"},"observation_digest":"sha256:ba9cb8f1b05cfc7c7c245347332fcadea5f0d5e47815441663643f6bf742a010","observation_id":"a459b328-50c2-45d6-863c-d30756b4087a","resolution":{"observed_at":"2026-08-16T01:07:10.338919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-15T21:55:30.374903Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08739","last_updated":"2025-05-13T16:52:19Z","snapshot_observed_at":"2026-08-20T00:15:27.904649Z","submitted_at":"2025-05-13T16:52:19Z","title":"Probability Consistency in Large Language Models: Theoretical Foundations Meet Empirical Discrepancies","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T21:55:30.374903Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2505.08739"},"observation_digest":"sha256:3960717db1ccf77e087abdfbba1b839975c9d6d70f0113cfd2d30444aa7a68e6","observation_id":"cb7ced7d-ba12-4b48-bdbf-06d6db0d3e7e","resolution":{"observed_at":"2026-08-15T21:55:30.374903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-06T18:09:11.418491Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09184","last_updated":"2025-07-23T02:46:25Z","snapshot_observed_at":"2026-08-20T00:19:54.600869Z","submitted_at":"2025-07-12T08:09:35Z","title":"MCA-LLaVA: Manhattan Causal Attention for Reducing Hallucination in Large Vision-Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:09:11.418491Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2507.09184"},"observation_digest":"sha256:056a9ff6e59cd6b4b02a1e31a5e908f8e6343e7b42fc6895f9488fdc78a255c1","observation_id":"3b3b67f3-291b-40f7-8796-9667f427ba3a","resolution":{"observed_at":"2026-08-06T18:09:11.418491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-06T17:52:38.257265Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10085","last_updated":"2025-07-14T09:11:33Z","snapshot_observed_at":"2026-08-13T14:13:10.992544Z","submitted_at":"2025-07-14T09:11:33Z","title":"Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:52:38.257265Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2507.10085"},"observation_digest":"sha256:3cb4f4f8b1b5080ba12b0af7377ad5d168a6b1332b311942efab7b1516d29ec5","observation_id":"ad1d02ba-5b0a-4a91-a233-34fc83234a39","resolution":{"observed_at":"2026-08-06T17:52:38.257265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2508.04204","last_updated":"2026-05-06T06:58:09Z","snapshot_observed_at":"2026-08-16T08:56:07.276124Z","submitted_at":"2025-08-06T08:35:10Z","title":"ReasoningGuard: Safeguarding Large Reasoning Models with Inference-time Safety Aha Moments","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T01:02:07.088724Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2508.04204"},"observation_digest":"sha256:5d65a41a27bfb35d9da5ca51ebda51010c51552fccb1b465f37256d6c6cb1bdd","observation_id":"7f296d16-5f56-449e-92bf-3136678bac45","resolution":{"observed_at":"2026-05-19T01:02:54.880194Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-04T06:15:45.793248Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06591","last_updated":"2026-08-03T06:23:29Z","snapshot_observed_at":"2026-08-13T09:14:40.173155Z","submitted_at":"2026-02-04T11:10:34Z","title":"What Makes Position Zero Special? A Mechanistic Study of Position Zero Attention Sinks in LLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T06:15:45.793248Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2603.06591"},"observation_digest":"sha256:f22588e62a6e5314876f7377d498ee1c7b8d27b0fcb9711ca9a7a41169c07b3e","observation_id":"ca10b16b-864f-4190-a90d-f7279d962d68","resolution":{"observed_at":"2026-08-04T06:15:45.793248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2604.03316","last_updated":"2026-07-26T08:57:51Z","snapshot_observed_at":"2026-08-15T12:52:26.617085Z","submitted_at":"2026-04-01T09:59:09Z","title":"When Sinks Help or Hurt: Unified Framework for Attention Sink in Large Vision-Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T23:20:51.899127Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2604.03316"},"observation_digest":"sha256:d46896a85f95411777b1b5624e4265042e583e485223f8a856f4fc3c187dd28d","observation_id":"cb695bea-f17b-4cd1-8ec2-1c15b83eab5b","resolution":{"observed_at":"2026-05-13T23:23:26.789469Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-02T17:04:25.869964Z","title":"arXiv preprint arXiv:2406.15765 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03316","last_updated":"2026-07-26T08:57:51Z","snapshot_observed_at":"2026-08-15T12:52:26.617085Z","submitted_at":"2026-04-01T09:59:09Z","title":"When Sinks Help or Hurt: Unified Framework for Attention Sink in Large Vision-Language Models","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T17:04:25.869964Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2604.03316"},"observation_digest":"sha256:d3fc7cf677d43ca828b279125a9a3ddce8024125acc1ae182cda0885dcd4edbe","observation_id":"f2ac77db-d179-4f51-b2cb-579a0943a951","resolution":{"observed_at":"2026-08-02T17:04:25.869964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2604.04500","last_updated":"2026-04-06T07:51:59Z","snapshot_observed_at":"2026-08-13T02:16:47.977396Z","submitted_at":"2026-04-06T07:51:59Z","title":"Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-10T19:59:19.379119Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2604.04500"},"observation_digest":"sha256:9518787d54946ea2c45dee3ee4ae97a22fc113bd05e4d5cac873741373005c06","observation_id":"d5e37c56-c7c1-4aa3-b5e2-e3dbe75093e3","resolution":{"observed_at":"2026-05-10T22:20:47.841443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2605.05741","last_updated":"2026-05-07T06:32:57Z","snapshot_observed_at":"2026-08-17T19:38:48.914653Z","submitted_at":"2026-05-07T06:32:57Z","title":"HyperLens: Quantifying Cognitive Effort in LLMs with Fine-grained Confidence Trajectory","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T11:38:49.630171Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2605.05741"},"observation_digest":"sha256:28ac25dd752d6e96b3f9ee77bc4ca7835de9c22241434b36ed4caef247c34589","observation_id":"ed7832ed-b4d2-4add-9227-c9488f9d8e30","resolution":{"observed_at":"2026-05-11T19:36:10.385501Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2605.21954","last_updated":"2026-05-21T03:40:22Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T03:40:22Z","title":"MLLMs Know When Before Speaking: Revealing and Recovering Temporal Grounding via Attention Cues","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T07:13:43.716510Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2605.21954"},"observation_digest":"sha256:14bb38e4a9c5ec7ad1c3996d32589706642bbb179c49ca351d54b454b24453b1","observation_id":"6ab08144-e77a-41c8-ad1a-0cef9f43c5f7","resolution":{"observed_at":"2026-05-22T07:14:42.391167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2605.29657","last_updated":"2026-05-28T09:20:47Z","snapshot_observed_at":"2026-08-21T10:47:38.807771Z","submitted_at":"2026-05-28T09:20:47Z","title":"OccamToken: Efficient VLM Inference with Training-Free and Budget-Adaptive Token Pruning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T08:46:09.062194Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2605.29657"},"observation_digest":"sha256:58c0e6f4916ae582340b83abb2aa0c295d0f1383df25200aa335415693266d70","observation_id":"1d687344-50de-4709-878f-ce935f0f5f5e","resolution":{"observed_at":"2026-06-29T08:53:16.164258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration","version":1},"cited_work":{"arxiv_id":"2406.15765","doi":"10.48550/arxiv.2406.15765","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.15765","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unveiling and harnessing hidden attention sinks: Enhancing large language models without training through attention calibration","venue":"arXiv (Cornell University)","work_id":"1dcd2ea4-a83f-4ddb-bc85-b5941c011fff","year":2024},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2406.15765","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:6f23a65047688ef5d7d8ed7d711ae7d18ca6be04efebf25197984fa06069f656","observation_id":"1b64c4fd-23a8-4368-a378-a1fdb94a8a8c","resolution":{"observed_at":"2026-06-28T23:32:46.662503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.15765/citation-record","integrity":"/paper/2406.15765/integrity","json":"/paper/2406.15765/citation-record.json","paper":"/paper/2406.15765"},"outbound":[],"paper":{"arxiv_id":"2406.15765","last_updated":"2024-06-22T07:00:43Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:40:33.481359Z","submitted_at":"2024-06-22T07:00:43Z","title":"Unveiling and Harnessing Hidden Attention Sinks: Enhancing Large Language Models without Training through Attention Calibration"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2406.15765."}