{"as_of":"2026-08-22T06:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55aadc97e7f83e6a8c863b1e8d35b923c17bfb8887029a6e5c22a5c4080d1999","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:07:53.551197Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-11T22:10:23.055200Z","title":"Yin and J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.03782","last_updated":"2025-06-05T17:58:57Z","snapshot_observed_at":"2026-08-21T17:34:14.367963Z","submitted_at":"2024-12-05T00:05:11Z","title":"The broader spectrum of in-context learning","version":3},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-08-11T22:10:23.055200Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2412.03782"},"observation_digest":"sha256:f3933e7d50bd707f07a8f67d0d4bd36734f7561ba367372d5814e05e667526f6","observation_id":"b6463463-55d7-4be2-8ef9-945f69528613","resolution":{"observed_at":"2026-08-11T22:10:23.055200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-07T00:41:59.663314Z","title":"Which attention heads matter for in-context learning?arXiv preprint arXiv:2502.14010, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13253","last_updated":"2025-06-16T08:49:42Z","snapshot_observed_at":"2026-08-16T09:38:12.019754Z","submitted_at":"2025-06-16T08:49:42Z","title":"Distinct Computations Emerge From Compositional Curricula in In-Context Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:59.663314Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2506.13253"},"observation_digest":"sha256:4753c1a5d8d57b0d93b963fa76b8cfd6d3b69e0100c7d8ab10ebb22534838d57","observation_id":"fd7f5f44-fb68-4b82-9977-e6950c7382dd","resolution":{"observed_at":"2026-08-07T00:41:59.663314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-15T19:07:53.551197Z","title":"Which attention heads matter for in-context learning? arXiv preprint arXiv:2502.14010, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17859","last_updated":"2025-06-26T16:54:57Z","snapshot_observed_at":"2026-08-21T03:12:22.825230Z","submitted_at":"2025-06-21T23:49:08Z","title":"In-Context Learning Strategies Emerge Rationally","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:07:53.551197Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2506.17859"},"observation_digest":"sha256:8c5ca6f1dee689537efb4aac561f3ff2f2a33da2313aba96ec1f601225dbaadc","observation_id":"c73ad69b-f4bd-4f2a-bc6d-13fb8007afbb","resolution":{"observed_at":"2026-08-15T19:07:53.551197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-06T05:00:04.950853Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-13T07:44:07.312192Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.950853Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:74d6abcbad5b79159f8f5fd49f3b92dbd8b0ce438344d4d4eb934dae33cfde59","observation_id":"559f2c11-27d4-4467-990f-fef5903a6315","resolution":{"observed_at":"2026-08-06T05:00:04.950853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-08-11T18:18:04.570790Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:b5ec1bd6f4dd49bfe7135cdb1203d1dafe87102b7ba13572af0424c08fc57eb2","observation_id":"926e1f80-5ad7-4062-b523-88bd109d9233","resolution":{"observed_at":"2026-05-18T13:31:25.452593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-03T21:06:40.820193Z","title":"above random,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16893","last_updated":"2026-07-05T02:34:16Z","snapshot_observed_at":"2026-08-18T13:50:34.534646Z","submitted_at":"2025-11-21T02:17:01Z","title":"Predicting the Emergence of Induction Heads in Language Model Pretraining","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:06:40.820193Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2511.16893"},"observation_digest":"sha256:a76c2fb003f449425e89cb6a73b49250578d1224b7b898d6bc67679578cfd5cf","observation_id":"027fbc6e-dc89-4746-bcf1-e574d0b49cbf","resolution":{"observed_at":"2026-08-03T21:06:40.820193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2512.13751","last_updated":"2026-05-09T08:34:38Z","snapshot_observed_at":"2026-08-11T20:36:34.223497Z","submitted_at":"2025-12-15T05:50:45Z","title":"MIDUS: Memory-Infused Depth Up-Scaling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T22:02:42.297041Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2512.13751"},"observation_digest":"sha256:4d5404f183ebbff2888776d2499fceff928d7f193443bb91e46d7ecfe19f3737","observation_id":"0cfbbeb3-fcd9-4dfd-8207-3ef371a7d86d","resolution":{"observed_at":"2026-05-16T22:03:36.145951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-03T01:00:44.265889Z","title":"URL https: //doi.org/10.24963/ijcai.2022/556","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.03335","last_updated":"2026-06-29T17:33:41Z","snapshot_observed_at":"2026-08-03T01:00:42.799874Z","submitted_at":"2026-02-11T16:06:59Z","title":"Compressed Sensing for Capability Localization in Large Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T01:00:44.265889Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2603.03335"},"observation_digest":"sha256:bcf14d1a7d5dde8e478c9c1d4903d188aee1b12e4e261981014c07c9444d456e","observation_id":"c562e1a4-b940-4fcc-9993-e97ba7558062","resolution":{"observed_at":"2026-08-03T01:00:44.265889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2604.23371","last_updated":"2026-04-25T16:35:25Z","snapshot_observed_at":"2026-07-06T23:09:38.799345Z","submitted_at":"2026-04-25T16:35:25Z","title":"When Context Sticks: Studying Interference in In-Context Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T08:31:14.231710Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2604.23371"},"observation_digest":"sha256:3a33b98ac2adfefb261b521a65e94c40d2195d70194097ee0785b9ae8edcdc41","observation_id":"af989d11-bc32-491e-a231-28d5f18cdc2b","resolution":{"observed_at":"2026-05-11T20:36:09.515952Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2605.05115","last_updated":"2026-05-06T16:46:03Z","snapshot_observed_at":"2026-08-07T10:12:24.411121Z","submitted_at":"2026-05-06T16:46:03Z","title":"Manifold Steering Reveals the Shared Geometry of Neural Network Representation and Behavior","version":1},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-05-08T17:47:09.591001Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2605.05115"},"observation_digest":"sha256:d47d2d8095668cc3e6d0826f58a658ec77ac46512e9f70a3d48c697625b43484","observation_id":"9a9112a7-f93c-4f42-8657-59c7aab3a662","resolution":{"observed_at":"2026-05-11T17:16:06.577442Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2605.20730","last_updated":"2026-05-20T05:26:38Z","snapshot_observed_at":"2026-08-17T00:54:33.947872Z","submitted_at":"2026-05-20T05:26:38Z","title":"Distributional Alignment as a Criterion for Designing Task Vectors in In-Context Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T05:32:01.059706Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2605.20730"},"observation_digest":"sha256:c94c77b2ce443203c57bd4cdb8ee820a69559640880b31c6a1ecdeac41e25130","observation_id":"f0849acc-6ddb-4948-a382-989a0e96e6ae","resolution":{"observed_at":"2026-05-21T05:33:58.583417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:5ef970aa18ffa11963d5101ee90eee045fbdccdb89554000af7a48bb625e3d45","observation_id":"081c2371-be90-4599-9a20-a7abffd78315","resolution":{"observed_at":"2026-06-28T23:32:46.694055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T20:46:01.403927Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:17be79f5383f413551f85d5f115482b3a19ec5846767de46259d5c68bca09c85","observation_id":"501bb876-5bfa-48af-bce6-6105dbbc89a6","resolution":{"observed_at":"2026-07-04T00:59:20.999931Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.19317","last_updated":"2026-06-29T15:31:17Z","snapshot_observed_at":"2026-08-15T08:10:13.451818Z","submitted_at":"2026-06-17T17:40:55Z","title":"Explaining Attention with Program Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T10:20:46.759958Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.19317"},"observation_digest":"sha256:f86843261b1901f99379c742f5746285b8002ccfb126e1538134441749528197","observation_id":"4dc3b032-f102-43d7-ab5f-642a70b5b295","resolution":{"observed_at":"2026-06-30T12:04:39.194166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Which attention heads matter for in-context learning?","venue":"ArXiv.org","work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2606.24467","last_updated":"2026-06-23T11:59:46Z","snapshot_observed_at":"2026-08-18T21:03:31.332486Z","submitted_at":"2026-06-23T11:59:46Z","title":"CompressKV: Semantic-Retrieval-Guided KV-Cache Compression for Resource-Efficient Long-Context LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:57.763089Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2606.24467"},"observation_digest":"sha256:b0f15f16a650e14d0db889b057cce90808eb3c26533e9328b798c048c0bd8646","observation_id":"2f9276c2-1721-4d88-bea3-3c653ebbe4fe","resolution":{"observed_at":"2026-07-04T16:49:58.030660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14010/citation-record","integrity":"/paper/2502.14010/integrity","json":"/paper/2502.14010/citation-record.json","paper":"/paper/2502.14010"},"outbound":[],"paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T13:49:57.967289Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2502.14010."}