{"as_of":"2026-08-23T16:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e661bf7f28eccdf1d70e0cdec31111f1160d182b3be340285f7caab87f6ae34","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:32:36.800225Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:47:19.953111Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2408.05147"},"observation_digest":"sha256:33397823e1dada3fa1d8bdee8ac28f20b5079a2d1678b7cdcca602aea3921875","observation_id":"d799f6df-df6a-4a56-8dec-6e051c7446b7","resolution":{"observed_at":"2026-05-15T05:47:20.049487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-11T23:54:24.491293Z","title":"Universal neurons in gpt2 language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02104","last_updated":"2024-12-03T02:54:31Z","snapshot_observed_at":"2026-08-16T12:56:12.864592Z","submitted_at":"2024-12-03T02:54:31Z","title":"Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey","version":1},"reference_index":267,"source":"pdf_text","source_observed_at":"2026-08-11T23:54:24.491293Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2412.02104"},"observation_digest":"sha256:bd89b3a263b54ffead01f4402a1f1378d719652dd29e55c8a932a76ff5f9cca8","observation_id":"cb6c2dec-109d-408f-bb46-b78ebe87ee8a","resolution":{"observed_at":"2026-08-11T23:54:24.491293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-09T22:24:53.855675Z","title":"C., Kheirkhah, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18823","last_updated":"2025-02-12T18:35:15Z","snapshot_observed_at":"2026-08-19T04:52:30.525360Z","submitted_at":"2025-01-31T00:36:30Z","title":"Transcoders Beat Sparse Autoencoders for Interpretability","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T22:24:53.855675Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2501.18823"},"observation_digest":"sha256:11c098f485908b820a6c7ab5c2ca46f781df23bdea919c8ff352363119242132","observation_id":"0b284469-f521-48a7-8ea5-57e1dedfdef2","resolution":{"observed_at":"2026-08-09T22:24:53.855675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-09T22:21:50.749829Z","title":"C., Kheirkhah, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.18838","last_updated":"2025-01-31T01:12:50Z","snapshot_observed_at":"2026-08-20T17:09:35.504109Z","submitted_at":"2025-01-31T01:12:50Z","title":"Partially Rewriting a Transformer in Natural Language","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T22:21:50.749829Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2501.18838"},"observation_digest":"sha256:7e28feea9f2298f3f9342da53bdbfcbc006ecf7fcff53b7b9daf35d96398e6ca","observation_id":"e29f0d38-d4eb-46d8-8247-0b1de984f8e0","resolution":{"observed_at":"2026-08-09T22:21:50.749829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-16T12:32:36.800225Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.800225Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:d99f28abe587c8504ed0bb00725d055ef04e2bbe208075e73112304cd43d7f90","observation_id":"29d081c7-3e59-4c9f-ab14-525ca45fc9bb","resolution":{"observed_at":"2026-08-16T12:32:36.800225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-07T14:42:37.678355Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17936","last_updated":"2025-05-23T14:14:17Z","snapshot_observed_at":"2026-08-16T21:38:11.278427Z","submitted_at":"2025-05-23T14:14:17Z","title":"Understanding Gated Neurons in Transformers from Their Input-Output Functionality","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:42:37.678355Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2505.17936"},"observation_digest":"sha256:3163e746c0a804036d7b05e81a4797b211c7a86aba13637c957a5acca0889f9a","observation_id":"a06b21c9-d9f1-418f-81c6-0ee5048e8bd9","resolution":{"observed_at":"2026-08-07T14:42:37.678355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-07T10:54:26.268366Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04142","last_updated":"2025-06-04T16:33:44Z","snapshot_observed_at":"2026-08-11T15:46:19.548845Z","submitted_at":"2025-06-04T16:33:44Z","title":"Establishing Trustworthy LLM Evaluation via Shortcut Neuron Analysis","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:54:26.268366Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2506.04142"},"observation_digest":"sha256:1d298774507e3ae170dc0c85b97d5dc5e5d51fd6d2792406c467cfe873c90095","observation_id":"1bbb4099-dfb9-49c3-8e17-5a5f76a07e9e","resolution":{"observed_at":"2026-08-07T10:54:26.268366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-06T18:08:49.719227Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09185","last_updated":"2025-07-12T08:10:10Z","snapshot_observed_at":"2026-08-15T14:14:24.554792Z","submitted_at":"2025-07-12T08:10:10Z","title":"Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T18:08:49.719227Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2507.09185"},"observation_digest":"sha256:5f1079653c6c3ef6723c983bafbc70ac19064ed795c8e6c01d5f7c6023f5f119","observation_id":"7906ead3-6274-40c2-ab06-820e0f5a241d","resolution":{"observed_at":"2026-08-06T18:08:49.719227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-06T15:39:46.392267Z","title":"Preprint, arXiv:2401.12181","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.22918","last_updated":"2025-07-21T07:09:32Z","snapshot_observed_at":"2026-08-17T13:56:31.903457Z","submitted_at":"2025-07-21T07:09:32Z","title":"Semantic Convergence: Investigating Shared Representations Across Scaled LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:39:46.392267Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2507.22918"},"observation_digest":"sha256:9757a0c4c56764cb51e82f7acc51eb770329db6f81a4bf5b8941035a32a922af","observation_id":"71362254-d1cc-48e2-a11f-600e6a887661","resolution":{"observed_at":"2026-08-06T15:39:46.392267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T17:37:54.082946Z","title":"Universal neurons in gpt2 language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.16109","last_updated":"2025-08-22T05:54:11Z","snapshot_observed_at":"2026-08-11T21:09:52.797279Z","submitted_at":"2025-08-22T05:54:11Z","title":"From Indirect Object Identification to Syllogisms: Exploring Binary Mechanisms in Transformer Circuits","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T17:37:54.082946Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2508.16109"},"observation_digest":"sha256:1b57c00cf39c36aa1c034a54f7a93521bd5783665533cfc487e7eb91b5e1eafa","observation_id":"c12dc704-8d09-42de-a30a-b4ae672c87ca","resolution":{"observed_at":"2026-08-05T17:37:54.082946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-04T11:33:15.014741Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.04500","last_updated":"2026-06-03T23:33:57Z","snapshot_observed_at":"2026-08-17T00:33:25.218184Z","submitted_at":"2025-10-06T05:26:52Z","title":"Expand Neurons, Not Parameters","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T11:33:15.014741Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2510.04500"},"observation_digest":"sha256:695956c14d58b5ac6dfa2aa65c72df8a9fc21ffe91a102a52add0fa0224fe3c7","observation_id":"54340b46-e7cd-436c-8ace-784b398c07b5","resolution":{"observed_at":"2026-08-04T11:33:15.014741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-02T20:46:30.089354Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.22600","last_updated":"2026-07-06T18:07:55Z","snapshot_observed_at":"2026-08-15T07:58:24.379302Z","submitted_at":"2026-02-26T04:09:11Z","title":"Transformers converge to invariant algorithmic cores","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T20:46:30.089354Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2602.22600"},"observation_digest":"sha256:2b55b40b7206ff5d7ed2fcda7a854fb825bc5f6dc2e3a68a02550e85b0da3e38","observation_id":"3b37325c-ff66-41b8-afff-238fb035411d","resolution":{"observed_at":"2026-08-02T20:46:30.089354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2604.04496","last_updated":"2026-04-06T07:46:04Z","snapshot_observed_at":"2026-08-12T15:17:50.858153Z","submitted_at":"2026-04-06T07:46:04Z","title":"The Indra Representation Hypothesis for Multimodal Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T20:06:03.531145Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2604.04496"},"observation_digest":"sha256:f5ac3b699931ce9a628bff415558fa8591b2492817b5001402458dd39f45e957","observation_id":"99fc2856-9273-464b-bcf5-edf067409c8c","resolution":{"observed_at":"2026-05-10T22:15:48.717334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2604.13386","last_updated":"2026-04-15T01:21:52Z","snapshot_observed_at":"2026-08-13T20:41:45.606489Z","submitted_at":"2026-04-15T01:21:52Z","title":"Linear Probe Accuracy Scales with Model Size and Benefits from Multi-Layer Ensembling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T13:50:14.400797Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2604.13386"},"observation_digest":"sha256:b512cbaf50a620d1ff967b1687bad439240194210fef8bb4b48dc129edf4690b","observation_id":"82799d4e-bfcd-49e3-8e3e-416885fe05cf","resolution":{"observed_at":"2026-05-10T14:10:29.169386Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2605.09438","last_updated":"2026-05-10T09:25:45Z","snapshot_observed_at":"2026-08-11T11:19:06.669125Z","submitted_at":"2026-05-10T09:25:45Z","title":"fmxcoders: Factorized Masked Crosscoders for Cross-Layer Feature Discovery","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:54:41.225199Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2605.09438"},"observation_digest":"sha256:1c3072a97082df3b3c8843be3383c99f7ef302d1a7dbbb7c7ea4071f27322d06","observation_id":"1f8ad2d9-9060-4004-bee0-5a9d3778b861","resolution":{"observed_at":"2026-05-12T05:51:24.058432Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:3e460310c5a7829eb4ecd06e462a0dbad89a451d0f97374b741ed0a6a9b1b949","observation_id":"e4f891b4-7868-4d9d-bba3-419ad924282e","resolution":{"observed_at":"2026-05-14T20:57:58.949222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:b71f0cfcecf1345f4ec55a02cd43768bc70bb78082f4da7d98d3cea455c5bcb3","observation_id":"390d3f0e-abf0-49fc-a8d3-4789ad401813","resolution":{"observed_at":"2026-05-15T04:59:44.422445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-20T21:49:47.934339Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:c9b7dfe7a1985faf3b25dcdce7ab038bf5a858df7b8d1078069d0e116bea9c87","observation_id":"f18ee9c1-0c67-44a8-a18e-761609f5ca0a","resolution":{"observed_at":"2026-05-20T21:53:47.075488Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2605.14075","last_updated":"2026-05-13T19:51:25Z","snapshot_observed_at":"2026-08-16T02:50:57.162044Z","submitted_at":"2026-05-13T19:51:25Z","title":"Rethinking Layer Relevance in Large Language Models Beyond Cosine Similarity","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-15T05:05:01.099084Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2605.14075"},"observation_digest":"sha256:1df52138f6407ce45867e7c998863fb9809664b0294a7340ddd8afcc92580bd2","observation_id":"96799436-8e86-4fcd-bbac-dc692664046c","resolution":{"observed_at":"2026-05-15T05:09:46.230154Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":"2401.12181","doi":"10.48550/arxiv.2401.12181","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal Neurons in","venue":"arXiv (Cornell University)","work_id":"eb5860a6-61cb-43e3-8b19-4ddbd580abe0","year":2024},"citing_paper":{"arxiv_id":"2606.02385","last_updated":"2026-06-01T15:34:34Z","snapshot_observed_at":"2026-08-13T04:50:21.182396Z","submitted_at":"2026-06-01T15:34:34Z","title":"How Optimality Structures Sparse Dictionaries: A Theory for Understanding SAE Representations","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-28T11:36:45.020411Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2606.02385"},"observation_digest":"sha256:48594ced998738e5913084bac40af05023eccce9eeefc34a0f0a62b767c08641","observation_id":"a1a11a95-db3f-4493-8c89-f51316a58cf7","resolution":{"observed_at":"2026-07-02T01:46:26.299246Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-01T23:15:23.410991Z","title":"Universal neurons in gpt2 language models.arXiv preprint arXiv:2401.12181, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-19T09:54:53.193795Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:23.410991Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:0c7b631e9f0cf28239ad9388835266a7de74a13621056494f6626e7d7d8111fe","observation_id":"e4282052-0b48-4cd2-a8c1-80dab0433a15","resolution":{"observed_at":"2026-08-01T23:15:23.410991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-01T17:51:35.125183Z","title":"arXiv preprint arXiv:2401.12181 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17513","last_updated":"2026-07-20T03:38:17Z","snapshot_observed_at":"2026-08-20T01:49:05.583724Z","submitted_at":"2026-07-20T03:38:17Z","title":"After the Euclidean Highway: Hyperbolic Expert AI as the Next Innovation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T17:51:35.125183Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2607.17513"},"observation_digest":"sha256:8c97cc1d4c5766ddb1a49872bcc65a8982bfc8234eb55fb77dad650d8c52f33e","observation_id":"9c2b6e53-8a41-468c-8ea2-f0bc144de75a","resolution":{"observed_at":"2026-08-01T17:51:35.125183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-01T07:20:35.162084Z","title":"Gurnee, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.21491","last_updated":"2026-07-23T16:34:14Z","snapshot_observed_at":"2026-08-18T05:27:47.344322Z","submitted_at":"2026-07-23T16:34:14Z","title":"What, Where, and How: Disentangling the Roles of Task, Language, and Model in Code Model Representations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T07:20:35.162084Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2607.21491"},"observation_digest":"sha256:c7ecc99b6a4b9dba9a40bb627c4727ccd3f155597a57868718e595fa60bfa102","observation_id":"e13dbf6d-d0be-4870-bfc3-81a166505096","resolution":{"observed_at":"2026-08-01T07:20:35.162084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2401.12181/citation-record","integrity":"/paper/2401.12181/integrity","json":"/paper/2401.12181/citation-record.json","paper":"/paper/2401.12181"},"outbound":[],"paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2401.12181."}