{"as_of":"2026-08-04T06:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6c1e57515b85e6ac5c41bde627563e271413ac1d266341e73bd11fea773d046c","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T13:26:59.080330Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.24164/citation-record","integrity":"/paper/2509.24164/integrity","json":"/paper/2509.24164/citation-record.json","paper":"/paper/2509.24164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.311803Z","title":"write newline","venue":null,"work_id":"8e5fda61-e601-4df4-8204-015bee341570","year":null},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:64214ab11f6dc2026d73542e42d67f171dc6d25578349f96add7f7bd3f38fb17","observation_id":"f74335a6-966a-4167-a9bc-a91f8f027fba","resolution":{"observed_at":"2026-05-18T13:32:39.086425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"52ab6132-a23f-491f-9fc7-f99de9cde6d7","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:c6ef869cd503f8a0efac2b436b9ae12431c581da0d99a2c525d9e9c5e844705f","observation_id":"774763dd-749f-4669-ba28-ee60acb99053","resolution":{"observed_at":"2026-05-18T13:32:39.050998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5724.349588","doi":"10.5555/3495724.3495883","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":"3c5d9f39-12ca-4979-bedd-e375c6caa022","year":2020},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:68e0734d91617039efb8a3b621aa07568c5ade207b6b1e9059f4cd81ecfe3e48","observation_id":"e456663e-e25c-46d9-9bec-0cb35738f65b","resolution":{"observed_at":"2026-05-18T13:31:24.675511Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:43.181908+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:43.181908+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Iteration head: A mechanistic study of chain-of-thought","venue":null,"work_id":"c5914a62-16c0-43e9-a86e-23b972fe841a","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:af9ff427014b222ecab393d6d693cddcc5e2d1073bb2e107877b21f5664dd2a0","observation_id":"ab777a08-7f41-4e89-a19a-eba56713163a","resolution":{"observed_at":"2026-05-18T13:32:39.038102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Revisiting in-context learning inference circuit in large language models","venue":null,"work_id":"bf30e54c-c973-4503-8fe5-aad68d41a024","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:8a75ba8f9ac41690c16bc1715a26c3a5c3e8a5504a286d82ae138dbed1716a3a","observation_id":"8f1b8f5e-15f0-4bd7-b1a5-470727429773","resolution":{"observed_at":"2026-05-18T13:32:39.038398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Token-based decision criteria are suboptimal in in-context learning","venue":null,"work_id":"e13d3b30-2154-4da5-b87f-9832263d4686","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:9438d0386369a21afb7c357d7883381eaf6fdd4dea6c33b96fe7b8b945943619","observation_id":"e09ab12c-3d6c-41d6-a6e9-a4de9527986f","resolution":{"observed_at":"2026-05-18T13:32:39.034335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07321","last_updated":"2024-02-11T22:58:49Z","snapshot_observed_at":"2026-07-06T17:28:39.754296Z","submitted_at":"2024-02-11T22:58:49Z","title":"Summing Up the Facts: Additive Mechanisms Behind Factual Recall in LLMs","version":1},"cited_work":{"arxiv_id":"2402.07321","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.07321","snapshot_observed_at":"2026-07-04T06:19:38.852082Z","title":"Chaudhari, M., Nuer, J., and Thorstenson, R","venue":null,"work_id":"eb5afb83-eec2-4d9d-b746-6bb58e419656","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2402.07321","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:5c857dbf58b8baf81f37928d4f9300169fd90c11a683806295f42fd8a37538c9","observation_id":"a249412d-a2e5-454d-8311-7d9b1f33e184","resolution":{"observed_at":"2026-05-18T13:31:25.550071Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07011","last_updated":"2025-04-02T09:40:08Z","snapshot_observed_at":"2026-08-03T11:54:22.844654Z","submitted_at":"2024-07-09T16:29:21Z","title":"Induction Heads as an Essential Mechanism for Pattern Matching in In-context Learning","version":3},"cited_work":{"arxiv_id":"2407.07011","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.07011","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Induction heads as an essential mechanism for pattern matching in in-context learning","venue":null,"work_id":"efaa689d-f3b2-4cae-b784-f7206133f0b5","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2407.07011","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:15e6fb265d1c62d0e6a1b56de3edc843fb3eaa1fb5d9d580d1a9120e374aae4b","observation_id":"0831f31e-6986-478d-81dc-4149e079a3f7","resolution":{"observed_at":"2026-05-18T13:31:25.534344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/11736790_9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T01:08:47.502855Z","title":"The pascal recognising textual entailment challenge","venue":null,"work_id":"06379ed9-486e-48e9-84ec-ad24c85cd052","year":2006},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:f49f279869818049e7a7b01156aaece21a6a77e87d89055e0ec13a1bea4726a1","observation_id":"2aacaf67-0ef3-499d-9960-0d7f21307afc","resolution":{"observed_at":"2026-05-18T13:31:24.685378Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The commitmentbank: Investigating projection in naturally occurring discourse","venue":null,"work_id":"4833772c-c962-48f1-829b-d23fb6c6bb66","year":2019},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:2fe0a1137ad4335a01c8c5e28abcef61653275ba5416db7260f982930db427d9","observation_id":"9f2b5222-1a85-49ec-ae95-5b282afbe58c","resolution":{"observed_at":"2026-05-18T13:32:39.044431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":"2301.00234","doi":"10.48550/arxiv.2301.00234","metadata_source":"pith","pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A Survey on In-context Learning","venue":"cs.CL","work_id":"864701ca-cb36-4a91-9be8-e2b9b20679aa","year":2022},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:d7e55a82f6385b7119ed5aa487418c73189692fd499d5470388fabd43aeab997","observation_id":"48be0d6e-b882-4821-bc85-426b9ecfa1b5","resolution":{"observed_at":"2026-05-18T13:31:25.538365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":"7557ba8d-37c9-40ce-ad29-c05ce934d641","year":2021},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:c690378758aee99e5e6598cd2e01b5d016ec76d9727df4fca187039be540acab","observation_id":"178fe1a1-304d-4de8-ac52-90647f3b4a9a","resolution":{"observed_at":"2026-05-18T13:32:39.045672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:6885f656cec89cd9d852e05309a3b3e205f21541f21b78a728daa503737a8a18","observation_id":"f5c4a98b-5e4b-4262-a77b-9021be325db9","resolution":{"observed_at":"2026-05-18T13:31:25.525907Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09476","last_updated":"2024-03-12T07:00:02Z","snapshot_observed_at":"2026-07-06T15:55:28.974661Z","submitted_at":"2023-07-18T17:56:50Z","title":"Overthinking the Truth: Understanding how Language Models Process False Demonstrations","version":3},"cited_work":{"arxiv_id":"2307.09476","doi":"10.48550/arxiv.2307.09476","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.09476","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Overthinking the truth: Understanding how language models process false demonstrations","venue":null,"work_id":"17fcc3f0-2936-4870-bfd6-d55d6dcb949a","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2307.09476","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:f6940d991eeffb8a48eba14e44ac3fc2682ef754f47f703a9f03c34aca87fba6","observation_id":"89c8df0b-cf17-476d-b244-ef7f605d57e9","resolution":{"observed_at":"2026-05-18T13:31:25.529971Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.624","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T19:14:59.984097Z","title":"In-context learning creates task vectors","venue":null,"work_id":"164bfab3-038a-4eb5-8328-da5b797b32c0","year":2021},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:c1ba738b3396600c198f0927919b64941a1c3be34985adc3346c67737cea8ac5","observation_id":"fa023e8e-8509-46cf-b975-0aef8e3df8d7","resolution":{"observed_at":"2026-05-18T13:31:24.682419Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:55.255346+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:55.255346+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.17322","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:46:28.669384Z","title":"From compression to expansion: A layerwise analysis of in-context learning","venue":null,"work_id":"efdfa9f7-2ed5-41ab-8bcc-f2f0b31e6672","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:04cd8b7db7fc29987c0cd107282a63c1cae976922f8f5a08cda9ed848db0e55c","observation_id":"1a06b50d-dd3f-4aa3-8b70-d4b0b1c6aa01","resolution":{"observed_at":"2026-05-18T13:31:25.522154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18154","last_updated":"2024-02-28T08:34:41Z","snapshot_observed_at":"2026-07-06T17:36:40.933805Z","submitted_at":"2024-02-28T08:34:41Z","title":"Cutting Off the Head Ends the Conflict: A Mechanism for Interpreting and Mitigating Knowledge Conflicts in Language Models","version":1},"cited_work":{"arxiv_id":"2402.18154","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.18154","snapshot_observed_at":"2026-07-01T17:15:52.045162Z","title":"Cutting off the head ends the conflict: A mechanism for interpreting and mitigating knowledge conflicts in language models","venue":null,"work_id":"339a129c-8187-47a1-8c0c-7be6e9e40d7e","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2402.18154","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:16a692fb2f2c85b1b2f3bb484f87e58b6502c83a7ca9a91da8d8c51b69a1cf5b","observation_id":"6d50cdc4-db91-408f-89cb-2386b306c96e","resolution":{"observed_at":"2026-05-18T13:31:25.514207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.15807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The atlas of in-context learning: How attention heads shape in-context retrieval augmentation","venue":null,"work_id":"affdda88-a76e-4cbd-a7f0-ca6742338468","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:5979e973a939ba7ecf53a5ea7e101affc63a1bbd7a537605c39a7a5a87e7d352","observation_id":"aece3f90-198e-42b9-8bbd-742f70e967f4","resolution":{"observed_at":"2026-05-18T13:31:25.518047Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The geometry of prompting: Unveiling distinct mechanisms of task adaptation in language models","venue":null,"work_id":"13316e2c-9733-4e35-a028-b287c6ac3e47","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:94270154303ab665e6c7372be8451b807a3ea5c3d47d4f7be6d10b4899535482","observation_id":"7cd3d908-741e-4cde-b6c0-e535e6bf3dce","resolution":{"observed_at":"2026-05-18T13:32:39.061589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11225","last_updated":"2024-07-04T11:52:11Z","snapshot_observed_at":"2026-07-06T18:01:27.562276Z","submitted_at":"2024-04-17T10:19:15Z","title":"In-Context Learning State Vector with Inner and Momentum Optimization","version":2},"cited_work":{"arxiv_id":"2404.11225","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.11225","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In-context learning state vector with inner and momentum optimization","venue":null,"work_id":"80b3ead4-2298-4e8a-8d1a-be4b86ed6063","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2404.11225","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:ae9675fb73448d97cabdfdac915f525f41ca18735608f87700ab5e69c334c9e7","observation_id":"41847bc1-6dc2-4ad9-a35d-1275b7c119f3","resolution":{"observed_at":"2026-05-18T13:31:25.506483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning question classifiers","venue":null,"work_id":"c6a60d18-3303-44f6-8769-4d8c839cdc21","year":2002},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:24479582ab1dca2442899d8eea6876fe090e2f2c6b4c52b971f5867cd6553dfc","observation_id":"57e3b91e-4bba-4f47-8e27-e9dd9337f570","resolution":{"observed_at":"2026-05-18T13:32:39.058126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09458","last_updated":"2023-07-24T08:32:40Z","snapshot_observed_at":"2026-07-06T15:55:28.974661Z","submitted_at":"2023-07-18T17:39:04Z","title":"Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla","version":3},"cited_work":{"arxiv_id":"2307.09458","doi":"10.48550/arxiv.2307.09458","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.09458","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Does circuit analysis interpretability scale? evidence from multiple choice capabilities in chinchilla","venue":null,"work_id":"95103113-d08b-4a14-9224-8ba338841a25","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2307.09458","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:119f680702134f2754f16b6ef0f6e832e181fee3a6ec792f62a30bc9ea166e8a","observation_id":"05303c68-2ebd-4eb1-978a-a45f425a63c5","resolution":{"observed_at":"2026-05-18T13:31:25.502883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":"2311.06668","doi":"10.48550/arxiv.2311.06668","metadata_source":"pith","pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-07-10T08:06:57.840768Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":"cs.LG","work_id":"f06ff961-4c14-4aef-8ff4-d57ccf064907","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:6629e14887d79d575213ad57d653c1076b13d5e87e008701136e25071e59562e","observation_id":"5fb89356-fb44-4344-87a7-242d05d1f85e","resolution":{"observed_at":"2026-05-18T13:31:25.510244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.73189+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.73189+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d992cbc0-524f-4f14-a7b8-8ce5c3523ee8","year":2008},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:cfd37b4c15cfe66a0e7a917f085d867740cc3b284f678505f2dcbdbf02a28d9a","observation_id":"92211958-f856-4d91-ae6b-83480e4e3e66","resolution":{"observed_at":"2026-05-18T13:32:39.069230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":"2310.06824","doi":"10.18653/v1/2025.findings-acl.38","metadata_source":"pith","pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","venue":"cs.AI","work_id":"400e017f-8643-4166-b6da-a75d4446da80","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:3f74c6e7b60a7ab28b1633ff818abe8d8fb38f75edd2af998805c4a25e3421cb","observation_id":"cb037214-2a51-4fa9-b5f9-d51885b17b52","resolution":{"observed_at":"2026-05-18T13:31:25.542192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16130","last_updated":"2024-04-03T16:27:31Z","snapshot_observed_at":"2026-07-06T15:33:23.984280Z","submitted_at":"2023-05-25T15:04:01Z","title":"Language Models Implement Simple Word2Vec-style Vector Arithmetic","version":3},"cited_work":{"arxiv_id":"2305.16130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.16130","snapshot_observed_at":"2026-06-29T22:54:01.538379Z","title":"Language models implement simple word2vec-style vector arithmetic","venue":null,"work_id":"bc038039-501a-4fc8-b5ea-d04358678d36","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2305.16130","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:8bcf4bab8852dbf4684ba5e36b8fba45657d96de05389c9d9c50f3768f9cfbe7","observation_id":"67c11a7f-f8ec-4386-a935-0a9c587a5c75","resolution":{"observed_at":"2026-05-18T13:31:25.546382Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":"2202.12837","doi":"10.48550/arxiv.2202.12837","metadata_source":"pith","pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","venue":"cs.CL","work_id":"d2b537df-825d-4427-9575-fc0664c0962a","year":2022},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:8a671899135deea78ad429a6a1259b5fb68cbe86cf60fa135ef40b9ded8cac1c","observation_id":"e8aff86c-05c8-4d45-8605-de1e092dadcf","resolution":{"observed_at":"2026-05-18T13:31:25.498758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:22:50.486187+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:22:50.486187+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":"2209.11895","doi":"10.1145/3411763.3451760","metadata_source":"pith","pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"In-context Learning and Induction Heads","venue":"cs.LG","work_id":"db2b0911-2758-4a2a-99dc-15b14b91bd5e","year":2022},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:d55c1b17b1eb84ac94a7af6e927f1dac4e265a4f783a2bf62b608b438cdaa04d","observation_id":"b74d3a23-0645-4e8e-8083-006a19403913","resolution":{"observed_at":"2026-05-18T13:31:25.472866Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T02:23:10.795052+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:8b2325eb6647ceb12aaec66da776c56b497358a0deff5f31e787b9b203237c26","observation_id":"6510c5fe-1c60-486a-ac2a-ebd549395573","resolution":{"observed_at":"2026-05-18T13:31:25.468725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.527","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What in-context learning learns in-context: Disentangling task recognition and task learning","venue":null,"work_id":"76dc94b3-7aa2-4e35-a514-3365a5b0b867","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:fd0c9f544bf0644229c080eb9f1d990cea903b2487af6d071c1339d99db37f81","observation_id":"e3f0766c-6bf7-497f-b7e1-ae8ccd83c6d4","resolution":{"observed_at":"2026-05-18T13:31:24.678953Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0506075","last_updated":"2005-06-17T20:10:43Z","snapshot_observed_at":"2026-08-03T15:05:51.212875Z","submitted_at":"2005-06-17T20:10:43Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","version":1},"cited_work":{"arxiv_id":"cs/0506075","doi":null,"metadata_source":"pith","pith_arxiv_id":"cs/0506075","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","venue":"cs.CL","work_id":"b7e56d68-7460-46ed-aa0e-7aeaacc102bd","year":2005},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/cs/0506075","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:1a87e174dc1b3f4dcfd0aa3b51f75e1b07394ed1a921e4a60ceaf6dae2054196","observation_id":"d0a78978-1fb8-4ccc-9e7d-608f70a2ecbf","resolution":{"observed_at":"2026-05-18T13:31:25.476923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"2bc3e6e5-5f98-4d1b-94c7-85f23bae26cd","year":2019},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:1f9899461ebfd9591f74938e4901013412bd4297ef4dae213ff9fa7a36fec09a","observation_id":"79d895e1-0dbf-4395-93b7-43e9ee8fda9c","resolution":{"observed_at":"2026-05-18T13:32:39.075309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13055","last_updated":"2024-07-25T08:07:39Z","snapshot_observed_at":"2026-07-06T17:32:52.500465Z","submitted_at":"2024-02-20T14:43:39Z","title":"Identifying Semantic Induction Heads to Understand In-Context Learning","version":2},"cited_work":{"arxiv_id":"2402.13055","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.13055","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Identifying semantic induction heads to understand in-context learning, 2024 b","venue":null,"work_id":"66e582ce-7d28-4bab-a1ca-f8f2702e0adf","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2402.13055","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:9564ff36ba82ee45aa16de7a97d1e876118604870a5d44a90f76fa55083f77eb","observation_id":"50ed1084-2d77-45bd-9e70-abfd98a1cc21","resolution":{"observed_at":"2026-05-18T13:31:25.464861Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.09709","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:38:56.114620Z","title":"Large language models encode semantics in low-dimensional linear subspaces","venue":null,"work_id":"876b0a1c-5ec1-463c-a112-2ac974276e7b","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:4821c0922336123ed780c91c4e2bef1545ce61432d2900de52899417876e0a0b","observation_id":"cc21c51a-ceb1-402d-b944-f8fa078456b0","resolution":{"observed_at":"2026-05-18T13:31:25.460252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07129","last_updated":"2024-04-10T16:07:38Z","snapshot_observed_at":"2026-08-03T20:21:31.265255Z","submitted_at":"2024-04-10T16:07:38Z","title":"What needs to go right for an induction head? A mechanistic study of in-context learning circuits and their formation","version":1},"cited_work":{"arxiv_id":"2404.07129","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07129","snapshot_observed_at":"2026-07-11T01:27:45.952692Z","title":"arXiv:2404.07129 [cs]","venue":"cs.LG","work_id":"c142de73-7921-41a0-9b3c-fb9ef3a08cd1","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2404.07129","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:3a66f38548ebba0d92f3f1dcdc7f49868873f0666c95e6a35984cf1e0a4093b0","observation_id":"7466d26f-5644-4496-aad6-24b6875a03e5","resolution":{"observed_at":"2026-05-18T13:31:25.456593Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":"8928d059-d212-4a13-809a-402b02e3cd1c","year":2013},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:379189e2d55873aec43218fffef585acb56ccacd6cd4c12269b3bc050fd815b8","observation_id":"13c95899-fe05-4b8e-bfa7-579ee41b6612","resolution":{"observed_at":"2026-05-18T13:32:39.072206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09503","last_updated":"2024-12-28T17:15:28Z","snapshot_observed_at":"2026-08-04T05:15:12.034109Z","submitted_at":"2024-08-18T14:52:25Z","title":"Out-of-distribution generalization via composition: a lens through induction heads in Transformers","version":2},"cited_work":{"arxiv_id":"2408.09503","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.09503","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Out-of-distribution generalization via composition: a lens through induction heads in transformers","venue":null,"work_id":"87940d1f-4a43-4281-8607-6ba980e82013","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2408.09503","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:e5c4434bf708d11b75860f8991a485843050e1f6fe6941f037622c421ef8bcef","observation_id":"8cb9c1ef-7057-4499-9710-d12773229565","resolution":{"observed_at":"2026-05-18T13:31:25.429343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpret and improve in-context learning via the lens of input-label mappings","venue":null,"work_id":"00cfa0a5-af09-4d71-b1fe-501a0480915d","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:18159ff6f949a86172cb891af8e98af255b339a70835cd2dba62921e7b484f9d","observation_id":"f0e22313-2cc0-4b39-b981-a0730b2ccfd0","resolution":{"observed_at":"2026-05-18T13:32:39.079136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Black-box tuning for language-model-as-a-service","venue":null,"work_id":"3d8e106f-8e01-45b7-af1f-7688fc2f3289","year":2022},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:0086e78a05093e0a45fc40edf71cbf10fca0bdca5f63348059749d028cf65701","observation_id":"b0725e3f-8891-4cce-aaf2-ccb23555bcb1","resolution":{"observed_at":"2026-05-18T13:32:39.061936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15213","last_updated":"2024-02-25T18:32:18Z","snapshot_observed_at":"2026-07-06T16:37:23.707569Z","submitted_at":"2023-10-23T17:55:24Z","title":"Function Vectors in Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.15213","doi":"10.48550/arxiv.2310.15213","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.15213","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Li, Arnab Sen Sharma, Aaron Mueller, Byron C","venue":null,"work_id":"dbc5264a-aabf-4346-8cbe-123e943b13b8","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2310.15213","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:134736899898152b588daa96f01f5c7055c9d309a8bb28ed75501b4d9f40cb05","observation_id":"5d2a6c35-8b9e-44cf-a4b4-f5b531b56a7c","resolution":{"observed_at":"2026-05-18T13:31:25.493595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Baselines and bigrams: Simple, good sentiment and topic classification","venue":null,"work_id":"22287cef-d2a5-4c54-b9a8-8ce19fa6be3a","year":2012},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:d7613537bf1ef584e6b25dca23ea90e8c75f7236b9f7f04106557d10d1763e7b","observation_id":"53c22cb4-c17a-47c1-be54-2655b987c22c","resolution":{"observed_at":"2026-05-18T13:32:39.065777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":null,"work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:0ae1f165e3f02bdb3fd75b688e7fb33bf563335f03bafc5e20ac71f9e5678cc6","observation_id":"be039bba-4d1f-4288-92d1-1e4ecad38c07","resolution":{"observed_at":"2026-05-18T13:31:25.449430Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:74f67e693e93ec5c0073352515188fc9cc7fd4afde54326358d5d0fac2da942e","observation_id":"2b0d5996-fd96-4dfa-9cda-5df32c29ea00","resolution":{"observed_at":"2026-05-18T13:31:25.446040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.18752","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unifying attention heads and task vectors via hidden state geometry in in-context learning","venue":null,"work_id":"10bcc22e-c28e-475b-b996-02877b7d1900","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:1b74f25fa2200ab00cccd3bb4b7e98244c96e9578986fabfb5a0471391230b14","observation_id":"6521fcac-3d13-44d3-b639-893cf62a403f","resolution":{"observed_at":"2026-05-18T13:31:25.432930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-07-06T20:39:24.018489Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":"2502.14010","doi":"10.48550/arxiv.2502.14010","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Which attention heads matter for in-context learning?","venue":null,"work_id":"85830f9c-3133-4082-9c86-22545b6b8f4d","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:bfb5e3fe7d14dcd7dce714f5cc13caddbad6a1545385dab313aded5b6e42c1b1","observation_id":"926e1f80-5ad7-4062-b523-88bd109d9233","resolution":{"observed_at":"2026-05-18T13:31:25.452593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02872","last_updated":"2024-09-24T20:27:53Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:39:32Z","title":"How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning","version":3},"cited_work":{"arxiv_id":"2402.02872","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.02872","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How do large language models learn in-context? query and key matrices of in-context heads are two towers for metric learning","venue":null,"work_id":"c9469eca-f95b-4b92-b64c-f3025b8b25a0","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2402.02872","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:6adf4aae85fd49a4b852ee01d9526ece059899930103152cc268fda7d4b06e14","observation_id":"82d6af5a-ca42-4f94-a2da-efb7e0655c31","resolution":{"observed_at":"2026-05-18T13:31:25.443148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00153","last_updated":"2025-05-05T19:17:46Z","snapshot_observed_at":"2026-07-06T19:24:52.534713Z","submitted_at":"2024-09-30T18:52:53Z","title":"Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution","version":3},"cited_work":{"arxiv_id":"2410.00153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00153","snapshot_observed_at":"2026-07-03T10:27:56.539908Z","title":"Beyond single concept vector: Modeling concept subspace in llms with gaussian distribution","venue":null,"work_id":"6a109316-dd08-4262-8705-1a58bee7c50a","year":2025},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2410.00153","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:5cfbc8960b2bdd76181ab6a9a7bb9dd53d4ecf3eefe38909d8cfa6ab3636222e","observation_id":"4dea53fc-bc8e-4837-95cb-af9944b5aac0","resolution":{"observed_at":"2026-05-18T13:31:25.436794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-07-06T19:11:09.921186Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":"2409.03752","doi":"10.48550/arxiv.2409.03752","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Attention heads of large language models: A survey","venue":null,"work_id":"258f7d02-803f-483c-ba4e-55a1e5fd75cb","year":2024},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:035be50c7098d4a6605cc8a71528ac8ff4a7b76d3dd45bc035dd65ba7ec36471","observation_id":"4020f4f8-0be6-41a2-a3fd-40f3030bfbbf","resolution":{"observed_at":"2026-05-18T13:31:25.440201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T23:55:44.012295Z","title":"@esa (Ref","venue":null,"work_id":"b058608d-98d0-4821-a4ae-403d2b7cd411","year":null},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:1a9105b3161f7ebee64b28f9d08f9bcd213c59542dc09323c8ceeb8346a1dd1f","observation_id":"7715b12c-33af-4df7-af97-f7da784c33b6","resolution":{"observed_at":"2026-05-18T13:32:39.082935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T00:05:48.337191Z","title":null,"venue":null,"work_id":"ea79bfb8-d434-45e9-8607-416d3839ec5c","year":null},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:4864440a17178bb70618ffdbda9501b66ba2db7a40964b92ab21ed54d97f3800","observation_id":"b9f7267b-a41c-429b-97c5-5a2732b25629","resolution":{"observed_at":"2026-05-18T13:32:39.047754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d3e654b8-d2ee-4b2e-a2de-cb0c664f69c3","year":null},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:05a58d4e011cca8edeb3f4ed0e9d4884b08c59e944631cd2b2dc5bd891bbe681","observation_id":"a4cfe59c-f0d4-4afb-96e3-16605ffcdd34","resolution":{"observed_at":"2026-05-18T13:32:39.054373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":4,"verified_exact":30,"verified_fuzzy":14},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2509.24164."}