{"as_of":"2026-08-20T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5612b55902ba349102b0975974f20cb51df0678be9da91de6cbfa99325b48547","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:30:15.403215Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:29:35.724196Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:29:36.389729Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"cited_work":{"arxiv_id":"2505.12822","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12822","snapshot_observed_at":"2026-08-05T13:29:36.389729Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","venue":"cs.AI","work_id":"41cc0da7-2936-41d6-b07a-5b5826a4d849","year":2025},"citing_paper":{"arxiv_id":"2509.04479","last_updated":"2025-08-30T22:20:41Z","snapshot_observed_at":"2026-08-19T21:11:57.406656Z","submitted_at":"2025-08-30T22:20:41Z","title":"No Clustering, No Routing: How Transformers Actually Process Rare Tokens","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:29:35.724196Z"},"links":{"cited_paper":"/paper/2505.12822","citing_paper":"/paper/2509.04479"},"observation_digest":"sha256:8a689f61ef000c00b95050d5836f1071a1873899dbca60d097303d9466cce05e","observation_id":"76e057d5-34a7-48f8-9cf5-b4904f8c28f3","resolution":{"observed_at":"2026-08-05T13:29:36.472441Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12822/citation-record","integrity":"/paper/2505.12822/integrity","json":"/paper/2505.12822/citation-record.json","paper":"/paper/2505.12822"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.897969Z","title":"Bahri, J","venue":null,"work_id":"c1b320af-b31c-4f52-bb69-d2a96145e99f","year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.233270Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:2f20a48a987bcb9e7e96c0c071d22edd36d3a0016593fb0974465fc127fe9fb1","observation_id":"b64595a8-83a6-4cf5-b611-2fdf2ce0147e","resolution":{"observed_at":"2026-08-15T20:30:15.901456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.886689Z","title":null,"venue":null,"work_id":"888d5782-5edd-43f4-980e-2d1a46c0b6e1","year":1987},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.237494Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:ca3b1681794fd29624b9b98f0b5f35eccb793bcdf066b62451466780efdf77b8","observation_id":"08adb939-5427-4491-aaa8-9ad2a926acb0","resolution":{"observed_at":"2026-08-15T20:30:15.890525Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.240995Z","title":"Biderman, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.240995Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:b9b439c4bd90d37fc3ae659aa44b54f6e3fa44ee3467d042c22f67132b4007f3","observation_id":"e2d04baf-8d43-4a93-b8a5-ee0b7934efad","resolution":{"observed_at":"2026-08-15T20:30:15.240995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.867876Z","title":"Bohacek and H","venue":null,"work_id":"28301180-e2c1-40f0-9951-f3cfc2875f9f","year":2025},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.244271Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:7fdc3bbbbbc553581e10a984a6bf8bfbaded67d1e046d15a51a87dc86a77d097","observation_id":"c410c892-3494-463e-a0ca-e20f4de88acc","resolution":{"observed_at":"2026-08-15T20:30:15.871430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.855355Z","title":"Borgeaud, A","venue":null,"work_id":"a25e6c56-8c69-46a7-8e5c-60e2ffe1b18a","year":2022},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.249181Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:3f3ddbc92f0e493880550cb7c652fc4ab03b6f4b02f97d9ae776596301ffe6aa","observation_id":"f7e92ece-87fd-4ffe-a74c-3d74d773a391","resolution":{"observed_at":"2026-08-15T20:30:15.859844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10999","last_updated":"2023-10-17T05:03:57Z","snapshot_observed_at":"2026-08-16T14:51:31.637426Z","submitted_at":"2023-10-17T05:03:57Z","title":"On the structure and spectra of an induced subgraph of essential ideal graph of $\\mathbb{Z}_{n}$","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10999","snapshot_observed_at":"2026-08-15T20:30:15.254316Z","title":"Bricken, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.254316Z"},"links":{"cited_paper":"/paper/2310.10999","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:94c51041f27e8de608fe82d3736d190f54a7500c553ba98cbb52d1052a755d0c","observation_id":"59e6b7de-ff76-411c-8ffb-b0c94f4c3afe","resolution":{"observed_at":"2026-08-15T20:30:15.254316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.841570Z","title":null,"venue":null,"work_id":"5c2f70a4-0f59-4f52-88d2-2434ced5bf93","year":1901},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.259134Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:e510b6a0b4c953b58efa3a76f85641fd12fe6f1626490809ef8db7b3c55b3bfe","observation_id":"93661526-cc7c-4fc0-b811-2bdbb302a2a8","resolution":{"observed_at":"2026-08-15T20:30:15.846118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.829435Z","title":"Carey and E","venue":null,"work_id":"66c2b5dd-285c-4ca3-b82a-9747bf280b54","year":1978},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.263271Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:7b623cee577d0da94e84f518dbbd78ab432b68b536d810641b0013c40942d5e0","observation_id":"17e9e6c0-3145-463b-b355-8a1e31c63a5f","resolution":{"observed_at":"2026-08-15T20:30:15.834179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.815578Z","title":"Couillet and Z","venue":null,"work_id":"e368da6b-4493-49b3-b2f5-45348a5feb82","year":2022},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.267590Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:7cf7fe85fa58826f4450f0702e79ea1e39f66911dc3c2fd77118ad755777c52b","observation_id":"1c64187b-9f4c-4f66-b850-ad3760310894","resolution":{"observed_at":"2026-08-15T20:30:15.819906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07043","last_updated":"2024-05-31T12:27:52Z","snapshot_observed_at":"2026-08-16T14:19:37.980082Z","submitted_at":"2024-02-10T21:06:34Z","title":"A Tale of Tails: Model Collapse as a Change of Scaling Laws","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07043","snapshot_observed_at":"2026-08-15T20:30:15.272677Z","title":"Dohmatob, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.272677Z"},"links":{"cited_paper":"/paper/2402.07043","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:db40a2b1883337dfeae5cbfd6d2db26e6a8c92626c890192740b9e4093b35ac1","observation_id":"38d3d307-127e-4e37-a754-874103a3fc76","resolution":{"observed_at":"2026-08-15T20:30:15.272677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-15T20:30:15.277783Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.277783Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:741c378449f1a0433f58f11478e765e44f7b30eacf60f32a33cbb37f5371440c","observation_id":"ef2393fe-8f49-465a-9ab1-9b46c5d218bf","resolution":{"observed_at":"2026-08-15T20:30:15.277783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06087","last_updated":"2021-06-22T05:40:01Z","snapshot_observed_at":"2026-08-16T18:17:57.005492Z","submitted_at":"2021-06-10T23:50:51Z","title":"Causal Analysis of Syntactic Agreement Mechanisms in Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06087","snapshot_observed_at":"2026-08-15T20:30:15.282517Z","title":"Finlayson, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.282517Z"},"links":{"cited_paper":"/paper/2106.06087","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:f2cd8db6e7939e34c7c0642d0cef8d90819d7c57b4e03408df51ed41d8f592f2","observation_id":"ffc3c2c3-2a38-45b3-b24f-280cf1c7a31a","resolution":{"observed_at":"2026-08-15T20:30:15.282517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-15T20:30:15.286830Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.286830Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:8c3efa7c432fefa92f4a4c493ca33287ee229123557fd22afed9e1345c90a0c3","observation_id":"2140e357-6526-4305-9748-05729d19cc7b","resolution":{"observed_at":"2026-08-15T20:30:15.286830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-17T05:06:29.353999Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-15T20:30:15.290065Z","title":"Gurnee, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.290065Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:fccc36a56a4a7f94d22c18e4ca7b1684fdf4991c86e41ac3a99f030b4da161ae","observation_id":"41431003-4af2-4675-912a-b5fa5f3a99f9","resolution":{"observed_at":"2026-08-15T20:30:15.290065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.804947Z","title":"Hataya, H","venue":null,"work_id":"493192fe-2fd2-43fc-8a0e-c85ba7af6963","year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.293806Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:9c2fdbae421bec05110207561138a450ff449e0a1f822cd2a56758541afe2309","observation_id":"54106ddc-d9b7-4371-be7b-b85614e5d221","resolution":{"observed_at":"2026-08-15T20:30:15.808427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-15T20:30:15.297170Z","title":"Hoffmann, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.297170Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:82a1b71d318d081d81f1c8cdd04c9fa381f2e84ca76aa2510499db3ddc0c71f3","observation_id":"baed0247-bcb7-4a31-a9bf-761cd73fd40e","resolution":{"observed_at":"2026-08-15T20:30:15.297170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.792986Z","title":"Kandpal, H","venue":null,"work_id":"99e9fe36-db02-4284-b328-e1e377d40ac8","year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.301684Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:d6af2d394c5ab583ceb62622400da13af84c813807db71b43d4643e020231785","observation_id":"945b839c-7125-4149-89fa-37ae83f695f3","resolution":{"observed_at":"2026-08-15T20:30:15.796887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.306338Z","title":"Kumaran, D","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.306338Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:8ab7219a4c2e5479d9a01283d1326d493bb3d9b8c11908db585ccf5158c798b5","observation_id":"5e448274-43b0-4a2d-848a-141bb22f3f02","resolution":{"observed_at":"2026-08-15T20:30:15.306338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.772525Z","title":"Lewis, E","venue":null,"work_id":"db32e7dd-cadd-4c57-96a2-e1a8862e601b","year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.311157Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:8062f420812e92cf1fba395ffc02fd0ecab07b9cf657632b33e7bac6f61a212c","observation_id":"081741bb-d302-4404-9f22-c72d1cde6d25","resolution":{"observed_at":"2026-08-15T20:30:15.776509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.758614Z","title":null,"venue":null,"work_id":"e8a7a359-ab07-4a9e-9fa1-73285b1b0ef1","year":2024},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.315308Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:c4a9264e5abf4fda08a2e2d8fa3fde89631e63ee8bac4fe867b30cb6252faa1e","observation_id":"042cba02-f01e-486c-8c14-f978e1b97f28","resolution":{"observed_at":"2026-08-15T20:30:15.763029Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02173","last_updated":"2023-10-03T16:06:33Z","snapshot_observed_at":"2026-08-16T14:55:26.189815Z","submitted_at":"2023-10-03T16:06:33Z","title":"CNN photometric redshifts in the SDSS at $r\\leq 20$","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02173","snapshot_observed_at":"2026-08-15T20:30:15.319433Z","title":"Mallen, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.319433Z"},"links":{"cited_paper":"/paper/2310.02173","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:26bdd460556bec419c737a03c07d7b347e00f66dfe9d024e38fa8012d15bf16a","observation_id":"4a2956e7-6472-437a-85fe-f9e531e71be1","resolution":{"observed_at":"2026-08-15T20:30:15.319433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.746236Z","title":null,"venue":null,"work_id":"74a71d7c-e0fd-4c45-8019-79e5eec0e911","year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.323777Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:9ef6de7c28ba07d2c89d8b05d3d653ddc7b2278355ac4272975c625069cb9329","observation_id":"c475d35a-2cb1-4209-b668-a8c05ddfcda6","resolution":{"observed_at":"2026-08-15T20:30:15.749851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.734632Z","title":"Markson and P","venue":null,"work_id":"9203228b-cd0c-4829-9372-a0892ee7daad","year":1997},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.327081Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:4d9fcdc10ba14e5c5490635ac8b2ef1c58351e583becd551eb11cecc3eae6944","observation_id":"5cdc89ca-b64f-4bec-b3cd-b1d43491b4bb","resolution":{"observed_at":"2026-08-15T20:30:15.738421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08276","last_updated":"2019-01-24T08:20:42Z","snapshot_observed_at":"2026-08-14T17:26:38.187837Z","submitted_at":"2019-01-24T08:20:42Z","title":"Traditional and Heavy-Tailed Self Regularization in Neural Network Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.08276","snapshot_observed_at":"2026-08-15T20:30:15.331992Z","title":null,"venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.331992Z"},"links":{"cited_paper":"/paper/1901.08276","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:dd9dfd094c7825d0a6f936e3092dc27811522ef3add39ca5b7cd657a81bb7abe","observation_id":"c50bfb35-7bae-4ca1-b597-605d40208adb","resolution":{"observed_at":"2026-08-15T20:30:15.331992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.722722Z","title":null,"venue":null,"work_id":"bb17c169-cc42-444c-89ab-51d093b5723b","year":2021},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.336195Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:2062b335a81954c4bec704b8996b559273248d34c40207716ced08210f44a241","observation_id":"d46cd59e-1308-457a-9282-ea612ac16637","resolution":{"observed_at":"2026-08-15T20:30:15.726902Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.340954Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.340954Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:9f03078f7292e918ee82c0132ee713d41121a7b3d75942101213bef21d618e99","observation_id":"eca733e0-d9a1-4558-af19-e2d31a380eca","resolution":{"observed_at":"2026-08-15T20:30:15.340954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.345575Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.345575Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:e06810866d0eb164fa0e06f3d18335752233d0b4c1eade4acc963a5c8b025922","observation_id":"da1239a5-cc6d-469b-935d-48a9a982a4ba","resolution":{"observed_at":"2026-08-15T20:30:15.345575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.692091Z","title":null,"venue":null,"work_id":"5b69cd4d-f02f-46de-9d14-85e98ca7efc6","year":2014},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.350565Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:8372341cfd866aa755df6406daff0ffc8edf8d8ea825d326dca18db421b246be","observation_id":"9c2c42c0-16ec-4b9d-ba70-e87256df389b","resolution":{"observed_at":"2026-08-15T20:30:15.697197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-08-16T23:25:38.049210Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-15T20:30:15.354679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.354679Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:ce717896e855c80d2ce4bd8aaa23635bf31b66b58d2cf7549d2d0563391c6b86","observation_id":"3a239448-10d3-42a9-9e5e-41ad173eeef3","resolution":{"observed_at":"2026-08-15T20:30:15.354679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01506","last_updated":"2025-02-18T02:23:45Z","snapshot_observed_at":"2026-08-17T00:18:50.876112Z","submitted_at":"2024-06-03T16:34:01Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01506","snapshot_observed_at":"2026-08-15T20:30:15.358014Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.358014Z"},"links":{"cited_paper":"/paper/2406.01506","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:87af8e6c45b775b0936e05ea72592f09554ae64cb86977b8396674235c2cf83a","observation_id":"55a8c622-b1b8-44cf-9e79-3300aa26d060","resolution":{"observed_at":"2026-08-15T20:30:15.358014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.361956Z","title":"Raffel, N","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.361956Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:eec0e03030eb4d93d770603f3525511024010d652daa3dcf43567b24f98f13dc","observation_id":"41215a67-70b6-488f-a671-7750553460d5","resolution":{"observed_at":"2026-08-15T20:30:15.361956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.673744Z","title":null,"venue":null,"work_id":"f2c5be1c-64fe-43ad-96a4-5f65c0448fa8","year":2017},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.365664Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:0f7db1fc3bc39c51b208c52a9e6e8c53c95f83a3d73324b2a6f17d9ebd142c29","observation_id":"7cdaa8bd-0815-4114-b6b0-93736744308c","resolution":{"observed_at":"2026-08-15T20:30:15.677053Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.662434Z","title":"Stolfo, B","venue":null,"work_id":"f77a4371-9bc8-4574-8375-661f4f0c5207","year":2024},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.369055Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:daa4ad0a4c234b15354be223130050cdbc14f6382b9dc17c9f02ed9a5100500c","observation_id":"faa2d8c2-f628-412e-a30c-55c7cd909bde","resolution":{"observed_at":"2026-08-15T20:30:15.666201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"physics/0004057","last_updated":"2000-04-24T15:22:30Z","snapshot_observed_at":"2026-08-16T09:10:10.815975Z","submitted_at":"2000-04-24T15:22:30Z","title":"The information bottleneck method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"physics/0004057","snapshot_observed_at":"2026-08-15T20:30:15.372862Z","title":"Tishby, F","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.372862Z"},"links":{"cited_paper":"/paper/physics/0004057","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:300ecc9d645e61a12ed5c3cb6f073b3a69d332bb38891a44e5b2351a8be168d3","observation_id":"a886447b-b77a-4a11-ad45-50509252e5ee","resolution":{"observed_at":"2026-08-15T20:30:15.372862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.650035Z","title":"Truong, L","venue":null,"work_id":"f5fb415b-dbd1-4d89-b930-470f6e04f8a3","year":2020},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.377192Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:89e14f67033d26120a698a9f24cc619f35efb40705a0fa8e400d63dd4162ec55","observation_id":"74f23490-f1ef-49e0-812e-ded80f7e94a8","resolution":{"observed_at":"2026-08-15T20:30:15.654000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.637146Z","title":null,"venue":null,"work_id":"5aa31bd2-2922-4244-9745-1df83b706b3b","year":2016},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.382112Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:044b91c1d8fb318ef516608cbbd4b70f937a9c933db50ff3e53bd2469ab291b1","observation_id":"84828b2d-5ef6-4513-bd74-89b1f5be4faf","resolution":{"observed_at":"2026-08-15T20:30:15.641334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-17T00:14:01.413100Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-15T20:30:15.386576Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.386576Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:d9b87a89b7f316011ecc7d2b58e50c5872e365f29e53a3de8e5400c7734530a4","observation_id":"995b23ce-855e-4513-90a0-978e5da57139","resolution":{"observed_at":"2026-08-15T20:30:15.386576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.625226Z","title":null,"venue":null,"work_id":"105fb6c8-6d33-443f-b388-e759460d993c","year":1981},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.390974Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:b60e27b47ef5d28f79899c6e60d3086599e31900d535e101887107d59fd9d7a3","observation_id":"d93d81ac-bb67-4b14-9517-b7af783cb71a","resolution":{"observed_at":"2026-08-15T20:30:15.628995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.612162Z","title":null,"venue":null,"work_id":"7c21f2d9-fd19-41dc-9a04-47d0a9f8e9dd","year":2023},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.395206Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:cd601057e54f5b0530858888f1636c16f2269d193a4d3d702fe65265325cdf18","observation_id":"59cbd14f-2942-41ae-ac22-d8997a285b4a","resolution":{"observed_at":"2026-08-15T20:30:15.616338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.598380Z","title":"Zhang, G","venue":null,"work_id":"cd4e41b0-e207-4e67-8d2f-4ad08a99d3b3","year":2025},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.399509Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:9b8d8d8f6e4367178e27cf493d4cd60859a3495f5dea7aef095f4af6ab83d325","observation_id":"23406cd5-0d22-4bff-8155-8177888e78b7","resolution":{"observed_at":"2026-08-15T20:30:15.602723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:30:15.584040Z","title":null,"venue":null,"work_id":"0f9b9f20-587f-481a-9dd7-fbf51c2858aa","year":1949},"citing_paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:30:15.403215Z"},"links":{"citing_paper":"/paper/2505.12822"},"observation_digest":"sha256:43131451dd8e80e19353b5a04606da4fb86489f96d3053cfaff81359d21f98d6","observation_id":"4d30c2ac-8055-457f-8112-974dd4b688fd","resolution":{"observed_at":"2026-08-15T20:30:15.589026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.12822","last_updated":"2025-05-22T16:03:57Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-19T19:20:10.251398Z","submitted_at":"2025-05-19T08:05:13Z","title":"Emergent Specialization: Rare Token Neurons in Language Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 1 inbound Pith citation observation for arXiv:2505.12822."}