{"as_of":"2026-08-09T10:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0840842161a28a59a2daf854114ce7446a46dc647f27aacdfa0ff2cb419725c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:46:11.446469Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":5,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-08T13:46:11.446469Z","title":"Attention heads of large language models: A survey.arXiv preprint arXiv:2409.03752 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09647","last_updated":"2025-03-05T16:14:16Z","snapshot_observed_at":"2026-08-09T07:37:21.802104Z","submitted_at":"2025-02-11T00:04:32Z","title":"Unveiling Simplicities of Attention: Adaptive Long-Context Head Identification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T13:46:11.446469Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2502.09647"},"observation_digest":"sha256:797070ef819f06a99886e460a189e7a1ff6881a98239f9278195a917222db786","observation_id":"02ec2ad8-0dd1-4c47-9c1a-0b9dbffcc7da","resolution":{"observed_at":"2026-08-08T13:46:11.446469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T14:31:33.035007Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18799","last_updated":"2025-06-18T05:56:01Z","snapshot_observed_at":"2026-08-09T07:37:21.236571Z","submitted_at":"2025-05-24T17:19:34Z","title":"ALPS: Attention Localization and Pruning Strategy for Efficient Alignment of Large Language Models","version":4},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T14:31:33.035007Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2505.18799"},"observation_digest":"sha256:2f3df367d49a753ad0259d350cba2af4a378a97997a956597318324fbb41b677","observation_id":"698fa79a-24db-4df3-a301-20b075a410ff","resolution":{"observed_at":"2026-08-07T14:31:33.035007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-07T05:37:02.613759Z","title":"Zheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07501","last_updated":"2025-06-09T07:26:47Z","snapshot_observed_at":"2026-08-09T07:37:37.211419Z","submitted_at":"2025-06-09T07:26:47Z","title":"Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:37:02.613759Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2506.07501"},"observation_digest":"sha256:ae10189a46aa5594168b69d4b3fd264c92adf412237cd3f5e0ba813f43ba9334","observation_id":"ad525324-7368-4320-88d3-8cf0704dd80f","resolution":{"observed_at":"2026-08-07T05:37:02.613759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-06T05:00:04.960649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-09T03:46:52.706849Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.960649Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:005722e4064b120d4a5f04f62dc430c1e5ddb966927a21510e1a9d106fbc2b15","observation_id":"f850a8c1-c2d6-4877-a7ec-11ac5ecdee6f","resolution":{"observed_at":"2026-08-06T05:00:04.960649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T15:37:43.536871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19697","last_updated":"2025-08-27T09:06:28Z","snapshot_observed_at":"2026-08-08T13:03:53.302123Z","submitted_at":"2025-08-27T09:06:28Z","title":"Safety Alignment Should Be Made More Than Just A Few Attention Heads","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T15:37:43.536871Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.19697"},"observation_digest":"sha256:97af1fb358d5d11e0a076538ec7ec4f22002f745a2e146d1c236d2649ff8ae12","observation_id":"4a44ed90-9335-452d-8a3c-b35b33784fe5","resolution":{"observed_at":"2026-08-05T15:37:43.536871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:7591ce89065b50fb5efa04ccd494fe16c8bb32ee09419e7791a88cae141e31f1","observation_id":"4020f4f8-0be6-41a2-a3fd-40f3030bfbbf","resolution":{"observed_at":"2026-05-18T13:31:25.440201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-04T09:48:11.198103Z","title":"Attention heads of large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13554","last_updated":"2026-06-08T06:02:10Z","snapshot_observed_at":"2026-08-04T09:47:55.188440Z","submitted_at":"2025-10-15T13:49:51Z","title":"Attention Illuminates LLM Reasoning: The Preplan-and-Anchor Rhythm Enables Fine-Grained Policy Optimization","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-04T09:48:11.198103Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2510.13554"},"observation_digest":"sha256:c642afb2b57f24ac1e7b829cd115954734d26e03be560346e87646cddfb0c2d5","observation_id":"a3f1154b-35c4-4532-ac06-167f9ffe8d01","resolution":{"observed_at":"2026-08-04T09:48:11.198103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2602.11528","last_updated":"2026-04-18T03:07:48Z","snapshot_observed_at":"2026-07-06T22:45:34.674215Z","submitted_at":"2026-02-12T03:37:50Z","title":"Stop Tracking Me! Proactive Defense Against Attribute Inference Attack in LLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T05:22:59.050348Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2602.11528"},"observation_digest":"sha256:147ccec44a10a2fdf8e9b39e62b38e2d50c066e393d50d8e2ad6f862568f5b9e","observation_id":"9b3ae8f9-c7ac-46fb-8814-37fc495340e7","resolution":{"observed_at":"2026-05-16T05:27:23.284362Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-02T21:21:27.091107Z","title":"You are a Evil assistant","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.13249","last_updated":"2026-05-28T14:47:48Z","snapshot_observed_at":"2026-08-09T02:53:25.541953Z","submitted_at":"2026-02-24T07:26:50Z","title":"Steering at the Source: Style Modulation Heads for Robust Persona Control","version":2},"reference_index":1248,"source":"pdf_text","source_observed_at":"2026-08-02T21:21:27.091107Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2603.13249"},"observation_digest":"sha256:7a627231157bb8a26c6d5b18cc6967838d303083df646631974cf2179ae0f964","observation_id":"d598accc-1ca8-475c-bc32-76f6fcd57632","resolution":{"observed_at":"2026-08-02T21:21:27.091107Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2604.03764","last_updated":"2026-04-04T15:32:25Z","snapshot_observed_at":"2026-07-06T22:52:52.882543Z","submitted_at":"2026-04-04T15:32:25Z","title":"Automated Attention Pattern Discovery at Scale in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T18:26:01.863346Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2604.03764"},"observation_digest":"sha256:a1ce556d4c768ef3cf2f37e15f4cb05c90fcb23238e3dce6bc4aba1478038cb9","observation_id":"140baed5-55f7-4f79-a898-9f7705825bad","resolution":{"observed_at":"2026-05-13T18:28:06.489272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2604.06393","last_updated":"2026-04-07T19:23:47Z","snapshot_observed_at":"2026-08-04T11:45:10.032776Z","submitted_at":"2026-04-07T19:23:47Z","title":"ART: Attention Replacement Technique to Improve Factuality in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:48:22.430128Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2604.06393"},"observation_digest":"sha256:a7204b6749f50a754af3533401698cf25f1b873ae2d6c0f1e643e45bf392684c","observation_id":"841b8b8a-0bb0-453d-9caa-ce971fd7b92f","resolution":{"observed_at":"2026-05-10T22:30:50.943301Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2605.04641","last_updated":"2026-07-29T07:14:27Z","snapshot_observed_at":"2026-08-02T23:57:54.502941Z","submitted_at":"2026-05-06T08:32:30Z","title":"CAST: Mitigating Object Hallucination in Large Vision-Language Models via Caption-Guided Visual Attention Steering","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-08T18:05:38.705480Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2605.04641"},"observation_digest":"sha256:cc8fddc7f7d47aa4bb68398bd87903212af0c0eec352afc9283a88cd355abb48","observation_id":"c8bca735-3f20-4111-98e1-cf4272c5cd5c","resolution":{"observed_at":"2026-05-09T06:50:40.160785Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2605.10622","last_updated":"2026-05-11T14:16:25Z","snapshot_observed_at":"2026-07-06T23:22:32.858399Z","submitted_at":"2026-05-11T14:16:25Z","title":"Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-05-12T05:15:34.156717Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2605.10622"},"observation_digest":"sha256:af46d0982ef75b7cb7a95da30ac5abc1fc2b6414992b8150585e6db2ff6927af","observation_id":"ab29259f-1480-4cec-b053-1c5845fc335f","resolution":{"observed_at":"2026-05-12T05:16:24.336766Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2606.06840","last_updated":"2026-06-05T02:32:24Z","snapshot_observed_at":"2026-08-05T15:03:33.373071Z","submitted_at":"2026-06-05T02:32:24Z","title":"Characterize Then Distill: Mechanistic Reasoning in Large Output Spaces","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T22:22:52.690010Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2606.06840"},"observation_digest":"sha256:a1611ee79cd924cb3f12b503bb1994c13633aba93d90cb60357d4e7954553a69","observation_id":"e01004f9-2362-4d31-9a67-6e31162ef151","resolution":{"observed_at":"2026-06-27T22:31:21.547538Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention heads of large language models: A survey","venue":"arXiv (Cornell University)","work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-08-09T07:36:37.074805Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:57.763089Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2606.24467"},"observation_digest":"sha256:76f99f92633fefe932ce5693c8bfd84884c4b198fb756760e7040a3b594735a1","observation_id":"cc7873b9-9a69-4ffb-8bf2-7ca248dcc20f","resolution":{"observed_at":"2026-07-04T16:49:58.033929Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-01T01:17:54.315888Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25873","last_updated":"2026-07-28T15:38:12Z","snapshot_observed_at":"2026-08-07T14:16:27.867503Z","submitted_at":"2026-07-28T15:38:12Z","title":"How Do LLMs Read Bug Reports? An Empirical Study of Attention in LLMs for Automated Program Repair","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-01T01:17:54.315888Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2607.25873"},"observation_digest":"sha256:08df3f637db73f79fb979cc2db80163b3179fd64d953823ad147768cbb326093","observation_id":"6140481e-b5b6-4b2b-985f-f36813506511","resolution":{"observed_at":"2026-08-01T01:17:54.315888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.03752/citation-record","integrity":"/paper/2409.03752/integrity","json":"/paper/2409.03752/citation-record.json","paper":"/paper/2409.03752"},"outbound":[],"paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T07:37:01.932557Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2409.03752."}