Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-03T09:43:52.365784Z
Paper Citation Record · LEDGER
As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2601.12879.
A citation records a reference. It does not transfer a finding from one paper to another.
Typed states for the displayed outbound observations.
Source: paper_references, paper_reference_links, observed 2026-08-03T09:43:52.365784Z
One-hop event checks from named stored sources.
Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00
Pith citing papers itemized under the disclosed page cap.
Source: paper_references, paper_reference_links
A source-named dated measurement, never combined with another source.
Source: cited_works
35 of 35 outbound references displayed
External citation measurements
No source-named external measurement is stored.
Observation d0cc2fb5-b57f-4b0a-81a7-667964faf50b · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition On the biology of a large language model,
Reference 1
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 391cb797-e7a6-493c-be4d-39c5b88a5fe3 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Neuron-level circuits: Pruning MLPs to interpret their weights,
Reference 2
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d7548e98-44fb-43b2-a42c-a944b2ad7626 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Towards monosemanticity: Decomposing language models with dictionary learning,
Reference 3
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 802fd163-2658-46b5-8e27-14945fd23d91 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Towards automated circuit discovery for mechanistic interpretability,
Reference 4
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation faa2c21d-e8bc-478d-858e-625c118b0fa3 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Sparse autoencoders find highly interpretable features in language models,
Reference 5
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation fd28ad7c-102e-440f-a88c-684c6b7f23d3 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition A mathematical framework for transformer circuits,
Reference 6
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 835c8bab-0aa1-4283-ace1-20176783805a · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Scaling and evaluating sparse autoencoders
Reference 7
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation f7923efe-a802-45c1-8707-cda8d1dfea50 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Weight-sparse transformers enable circuit- level interpretability,
Reference 8
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 31ae78bf-96ed-4ae4-9325-64323a8dc453 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition How does GPT-2 compute greater- than? Interpreting mathematical abilities in a pre-trained language model,
Reference 9
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation ab53a23b-8503-44ad-9294-6d414d599586 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models
Reference 10
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4b0637bd-db8f-4c28-beb2-1e266751d905 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Locating and editing factual associations in GPT,
Reference 11
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation dcc84977-3b77-42ba-8fc9-d8c2854ad4db · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Opening the AI black box: program synthesis via mechanistic interpretability
Reference 12
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6266d2e6-4d8b-4f1a-a207-59b4d869d5d4 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Progress measures for grokking via mechanistic interpretability,
Reference 13
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 06044f44-1c1d-493f-8975-e7a5cd4fb4df · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Zoom in: An introduction to circuits,
Reference 14
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 4abdb7b7-c840-403d-b933-8e9640cbb065 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition In-context learning and induction heads,
Reference 15
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation c0de4904-b85e-414f-b009-f53bfdfae9a4 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Interpretability in weight-sparse language models,
Reference 16
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3c5c2b99-3f9d-4601-8375-34f7b0095473 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition WinoGrande: An adversarial Winograd schema challenge at scale,
Reference 17
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 6a87aa4f-61bd-4a52-bd04-0984d6918f92 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Axiomatic attribution for deep networks,
Reference 18
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 77943da8-d398-4488-a65e-a657a04e3cff · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Graph attention networks,
Reference 19
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation bb9c5879-4246-498a-9555-3f30ae24c950 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition A tutorial on spectral clustering,
Reference 20
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3db8098d-c348-4ddc-ba18-173046f9eed1 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Interpretability in the wild: A circuit for indirect object identification in GPT-2 small,
Reference 21
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 3309cf29-2ca0-489c-a845-785cf7340b0f · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition HellaSwag: Can a machine really finish your sentence?
Reference 22
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 1ab5c987-1b91-4bbf-a132-c016e5f8b48b · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Defining and quantifying the emergence of sparse concepts in DNNs,
Reference 23
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 14567aa2-d0be-4117-9d97-a26f66e3f28e · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Explaining Generalization Power of a DNN Using Interactive Concepts
Reference 24
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 108f8857-6bb4-4ef9-a159-34eaad577db0 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Where We Have Arrived in Proving the Emergence of Sparse Symbolic Concepts in AI Models
Reference 25
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 7661e431-78d3-4658-89f7-ff4c76786339 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Discovering transformer circuits via a hybrid attribution and pruning framework,
Reference 26
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 32c0e022-4ff3-4b37-ab01-bc282130c0b7 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Finding Transformer Circuits with Edge Pruning
Reference 27
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 41f662ed-8cda-45f9-8513-d84adc21fdd9 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition The Local Interaction Basis: Identifying Computationally-Relevant and Sparsely Interacting Features in Neural Networks
Reference 28
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation e6ba8fc2-78e3-4460-b558-56d18494edc5 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Functional faithfulness in the wild: Circuit discovery with differentiable computation graph pruning,
Reference 29
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 5654fa34-3495-42a0-9255-8f73d36c51b5 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Automatically Identifying Local and Global Circuits with Linear Computation Graphs
Reference 30
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 869198f6-eea5-4563-9323-7ec30859625e · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Jacobian Sparse Autoencoders: Sparsify Computations, Not Just Activations
Reference 31
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 0d05f45f-e122-4ca0-b692-394ffce71a70 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Weight-sparse transformers have interpretable circuits,
Reference 32
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 320a465d-0560-4a4a-8d81-b6836593b1a3 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Language models can explain neurons in language models,
Reference 33
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation d3f8a902-d44a-4d03-aac9-0cbb97c3e0c1 · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Scaling monosemanticity: Extracting interpretable features from Claude 3 Sonnet,
Reference 34
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
Observation 099071a3-e247-46cf-b4f2-f173e10818af · outbound
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition Does Circuit Analysis Interpretability Scale? Evidence from Multiple Choice Capabilities in Chinchilla
Reference 35
Source-reported events for the cited work
Unavailable: canonical work link unavailable.
No inbound Pith citation observations are available.