{"as_of":"2026-08-12T08:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2a877b82f860f5446ec37a7f7577df093d57dc9ae5dfe4e2fff0f559e7301b53","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:12:57.956319Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.15750/citation-record","integrity":"/paper/2412.15750/integrity","json":"/paper/2412.15750/citation-record.json","paper":"/paper/2412.15750"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.261173Z","title":"Frantar, E.; and Alistarh, D","venue":null,"work_id":"93ac2ae6-da67-42a9-b655-9e190d4e76f2","year":2021},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.871916Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:fc966a9a061c4adf1d89122f1cfc98d285f98d25e07d0aaf9d0dcbeb577e50e3","observation_id":"ddad7123-beb5-4ad5-a409-fe0906be8c9a","resolution":{"observed_at":"2026-08-11T11:12:58.264660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17806","last_updated":"2024-07-15T12:07:09Z","snapshot_observed_at":"2026-08-09T11:10:36.208837Z","submitted_at":"2024-03-26T15:44:58Z","title":"Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17806","snapshot_observed_at":"2026-08-11T11:12:57.875562Z","title":"arXiv preprint arXiv:2403.17806","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.875562Z"},"links":{"cited_paper":"/paper/2403.17806","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:c257ea25dee004ec0ca4ff8de97f33c579630f799a4e04ff6ebaed7c662ba6d4","observation_id":"169fcbef-6b05-4749-acbf-4032fac2c4c6","resolution":{"observed_at":"2026-08-11T11:12:57.875562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10670","last_updated":"2022-12-20T22:11:35Z","snapshot_observed_at":"2026-08-10T02:12:11.712418Z","submitted_at":"2022-12-20T22:11:35Z","title":"In-context Learning Distillation: Transferring Few-shot Learning Ability of Pre-trained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10670","snapshot_observed_at":"2026-08-11T11:12:57.883145Z","title":"CoRR, abs/2212.10670","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.883145Z"},"links":{"cited_paper":"/paper/2212.10670","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:c595971acdbeaf925658e789442031913b8592085c9213f4a528e42decc6d6b7","observation_id":"45df0b4a-33ca-4c9c-958a-3fa98f7bc5a5","resolution":{"observed_at":"2026-08-11T11:12:57.883145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.250333Z","title":"In 2020 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 8046–8056","venue":null,"work_id":"c9b80641-5afd-4925-ada5-df6cd0836de3","year":2020},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.887908Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:31431fbe4378e947b1ba5b476e5e51b739b365c3cd448615ef9185a5901825cd","observation_id":"60ec9166-0ce8-4f13-b9ff-68134fd3d618","resolution":{"observed_at":"2026-08-11T11:12:58.253991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-11T11:12:57.891817Z","title":"arXiv preprint arXiv:2001.08361","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.891817Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:1ee5cf6d88921d855a3091b87d55c4b181b553fc7d1e009b79befb56b50781f0","observation_id":"4651da23-7547-414d-8e37-7ec3e2c67bcf","resolution":{"observed_at":"2026-08-11T11:12:57.891817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17888","last_updated":"2023-05-29T05:22:11Z","snapshot_observed_at":"2026-08-07T18:58:35.737110Z","submitted_at":"2023-05-29T05:22:11Z","title":"LLM-QAT: Data-Free Quantization Aware Training for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17888","snapshot_observed_at":"2026-08-11T11:12:57.899535Z","title":"arXiv preprint arXiv:2305.17888","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.899535Z"},"links":{"cited_paper":"/paper/2305.17888","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:73924f36417853657f20ba7df6add822aff18cdbfa78890a4fd086274a24ceda","observation_id":"3ac5574f-07ba-4730-b1b8-de3cf0bf1b3c","resolution":{"observed_at":"2026-08-11T11:12:57.899535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15771","last_updated":"2023-07-28T19:13:26Z","snapshot_observed_at":"2026-08-06T01:59:30.696076Z","submitted_at":"2023-07-28T19:13:26Z","title":"The Hydra Effect: Emergent Self-repair in Language Model Computations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15771","snapshot_observed_at":"2026-08-11T11:12:57.903041Z","title":"arXiv preprint arXiv:2307.15771","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.903041Z"},"links":{"cited_paper":"/paper/2307.15771","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:101e5c312a0cbafe10eb2e26a1e8af31ae7bb70d75567750477f9e4fe045e0e7","observation_id":"3ab1cce8-5160-4710-b4e9-d7e339452e26","resolution":{"observed_at":"2026-08-11T11:12:57.903041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.238060Z","title":"Advances in Neural Information Processing Systems, NeurIPS 2022 , 35: 17359–17372","venue":null,"work_id":"0423d862-683b-46d0-9832-2c77d45a23d1","year":2022},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.906974Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:c350d086bd9d27645f7024866e58a77dbe74cbcaea7604cb0902fc608714c92c","observation_id":"72e91eb0-6257-4452-906c-18a85d60044c","resolution":{"observed_at":"2026-08-11T11:12:58.242297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.225319Z","title":"Https://transformer-circuits.pub/2022/in-context- learning-and-induction-heads/index.html","venue":null,"work_id":"57a03288-355f-4ec4-87de-2d68d92e2fae","year":2022},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.910929Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:cdbdf53bb0b8852917aac6167ab1b022e0efb95b2e7fed0be1b5dd69c925e67e","observation_id":"b6e721a2-b73f-46c6-ab9e-eeb311cc3ebc","resolution":{"observed_at":"2026-08-11T11:12:58.229590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09557","last_updated":"2024-04-01T06:09:41Z","snapshot_observed_at":"2026-07-06T13:22:35.494601Z","submitted_at":"2022-06-20T03:48:17Z","title":"LUT-GEMM: Quantized Matrix Multiplication based on LUTs for Efficient Inference in Large-Scale Generative Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09557","snapshot_observed_at":"2026-08-11T11:12:57.915322Z","title":"arXiv preprint arXiv:2206.09557","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.915322Z"},"links":{"cited_paper":"/paper/2206.09557","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:51a5062ce8ba5f77b82732bfd0f6d99eebbd6ad74c305072ee70b7df70756670","observation_id":"d55f039c-770e-4a77-89ff-9c17ddc0b075","resolution":{"observed_at":"2026-08-11T11:12:57.915322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03773","last_updated":"2023-02-07T22:05:55Z","snapshot_observed_at":"2026-08-11T01:12:39.939983Z","submitted_at":"2023-02-07T22:05:55Z","title":"What Matters In The Structured Pruning of Generative Language Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03773","snapshot_observed_at":"2026-08-11T11:12:57.923654Z","title":"Shridhar, K.; Stolfo, A.; and Sachan, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.923654Z"},"links":{"cited_paper":"/paper/2302.03773","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:2d3576744d41ffbb95f9ff097e9882a14abe28f6d2f7e7701f40192b520779ff","observation_id":"09b759b7-c049-45ed-b124-21e351c3c0c9","resolution":{"observed_at":"2026-08-11T11:12:57.923654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.201201Z","title":"In Rogers, A.; Boyd-Graber, J.; and Okazaki, N., eds., Find- ings of the Association for Computational Linguistics: ACL 2023, 7059–7073","venue":null,"work_id":"a2223858-eb7d-4b48-be8c-9482d4470994","year":2023},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.928649Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:aefbae2c32c570feaba32a736e57d59588fe18cf432f3276f153bdc1c0d22dac","observation_id":"c7483f48-7b7c-400d-adac-bd1bc89fa158","resolution":{"observed_at":"2026-08-11T11:12:58.205408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-11T11:12:57.932676Z","title":"arXiv preprint arXiv:2306.11695","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.932676Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:b4353079ec06ebb1ad6065c87ef4fff0482cd321629f373de7e7ae7ba13e2e43","observation_id":"70a7926c-4bda-4bdc-9b7c-f379e1663fdb","resolution":{"observed_at":"2026-08-11T11:12:57.932676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-11T11:12:57.940954Z","title":"arXiv preprint arXiv:2201.08239","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.940954Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:204c16412b76d6ef0abdd5ecf5d91d9e9ca439e66b9576cefe2dacea1dff1324","observation_id":"5471bffd-e177-4bf7-bffa-59f1c0a4fbe2","resolution":{"observed_at":"2026-08-11T11:12:57.940954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.175868Z","title":"In Proceedings of the 2020 Confer- ence on Empirical Methods in Natural Language Process- ing: System Demonstrations, 38–45","venue":null,"work_id":"443446ec-51ac-4131-8959-4a4c312d7d6f","year":2020},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.949315Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:7306e6186e7a570121437e7293bf1a2b49a1b29b0e6c8f081f060d976293f261","observation_id":"1feb37e5-379d-44d0-b937-ca86ba6afdbc","resolution":{"observed_at":"2026-08-11T11:12:58.180697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18403","last_updated":"2024-08-07T03:30:30Z","snapshot_observed_at":"2026-08-09T12:33:50.387527Z","submitted_at":"2023-05-28T15:15:48Z","title":"LoRAPrune: Structured Pruning Meets Low-Rank Parameter-Efficient Fine-Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18403","snapshot_observed_at":"2026-08-11T11:12:57.952950Z","title":"arXiv preprint arXiv:2305.18403","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.952950Z"},"links":{"cited_paper":"/paper/2305.18403","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:b0e1a9441ff4ec890816d482ce822b4aaa9404dfd4872aba5e8781829856760a","observation_id":"86e9b979-4933-4fda-8396-03b73a1673aa","resolution":{"observed_at":"2026-08-11T11:12:57.952950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07633","last_updated":"2024-07-30T13:14:55Z","snapshot_observed_at":"2026-08-06T06:16:16.015146Z","submitted_at":"2023-08-15T08:31:05Z","title":"A Survey on Model Compression for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07633","snapshot_observed_at":"2026-08-11T11:12:57.956319Z","title":"The Chief Executive Officer (CEO","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.956319Z"},"links":{"cited_paper":"/paper/2308.07633","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:575578a1b8a595f1fd2228f5d86fa94c9d6955efac8cb0168bad7ebc60ec3b90","observation_id":"1587f2f9-a5d6-4e24-9ea5-e37b9dc581d4","resolution":{"observed_at":"2026-08-11T11:12:57.956319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T11:12:57.895877Z","title":"arXiv preprint arXiv:1412.6980","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.895877Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:426565b4d51a9a647f8ed4fd16a605c04c1fe717ea22329ad03e00c3ddb7170f","observation_id":"684f48ae-0f98-47cc-bc33-1835c2e87470","resolution":{"observed_at":"2026-08-11T11:12:57.895877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T11:12:57.879496Z","title":"CoRR, abs/1503.02531","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.879496Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:5c60af1f7222245dc833fb72a590c90c4135ea33bb1cecd41e510c75e4d012ca","observation_id":"87063ed9-9559-4f93-9fa7-a1577da29aa9","resolution":{"observed_at":"2026-08-11T11:12:57.879496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.189195Z","title":null,"venue":null,"work_id":"32811e4e-8b06-4118-a7de-c77741090834","year":2017},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.945435Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:1593020c3dd641a1b424b382940ea066daf50e88bd22fa43b279c3072c31e242","observation_id":"3d5e3cc3-a973-4bc7-acf8-76a7662710b9","resolution":{"observed_at":"2026-08-11T11:12:58.193208Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.213434Z","title":null,"venue":null,"work_id":"15457e6c-6e01-40c8-b09f-fba4d0551a4a","year":2018},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.919349Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:55b7469c7add56ba505268e3fe56fd1a6390dba9e0148a6c8521dea0177ba10d","observation_id":"fe72f192-da06-46d1-bef3-e84268b28754","resolution":{"observed_at":"2026-08-11T11:12:58.217338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.12136","last_updated":"2019-03-28T17:23:50Z","snapshot_observed_at":"2026-07-06T07:42:21.954799Z","submitted_at":"2019-03-28T17:23:50Z","title":"Distilling Task-Specific Knowledge from BERT into Simple Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.12136","snapshot_observed_at":"2026-08-11T11:12:57.936739Z","title":"arXiv preprint arXiv:1903.12136","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.936739Z"},"links":{"cited_paper":"/paper/1903.12136","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:ab82cc010c8f20347b4a16b25fc7249de556b944d0adef1377637e1f12041b3c","observation_id":"623c61a6-7a4c-4037-95d7-babf3dc0cf0d","resolution":{"observed_at":"2026-08-11T11:12:57.936739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:12:58.271479Z","title":"Ad- vances in Neural Information Processing Systems, NeurIPS 2020, 33: 1877–1901","venue":null,"work_id":"05624db4-0009-42a5-81c5-0e21a074949b","year":2020},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.864079Z"},"links":{"citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:07f692fe30327d07c50c17d6d7267a87f574808b73377c0a100780bd4042fc2d","observation_id":"bc1a2462-150c-45b5-b790-efb8293bb271","resolution":{"observed_at":"2026-08-11T11:12:58.275830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T11:12:57.868130Z","title":"arXiv preprint arXiv:2209.10652","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.868130Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:a107c9c8c0908376d2fa3aa2cc2d8dc51b99ab0ae87ebaece5731d82d24017d2","observation_id":"224feb25-e902-4a3b-9169-ff53d94157e8","resolution":{"observed_at":"2026-08-11T11:12:57.868130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T11:12:57.854841Z","title":"arXiv preprint arXiv:2303.08774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.854841Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:448047074022093e64036232bb74fa8c7cd1a739c2b45ca745d410be68109138","observation_id":"c994f6d3-a967-47ea-82b0-c7969aa1c62c","resolution":{"observed_at":"2026-08-11T11:12:57.854841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16778","last_updated":"2025-04-02T15:50:36Z","snapshot_observed_at":"2026-08-11T11:03:29.263687Z","submitted_at":"2024-06-24T16:40:54Z","title":"Finding Transformer Circuits with Edge Pruning","version":3},"cited_work":{"arxiv_id":"2406.16778","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16778","snapshot_observed_at":"2026-08-11T11:12:58.150318Z","title":"Finding Transformer Circuits with Edge Pruning","venue":"cs.CL","work_id":"262d9b2b-e210-4358-9b01-36c077d4c668","year":2024},"citing_paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T11:12:57.859721Z"},"links":{"cited_paper":"/paper/2406.16778","citing_paper":"/paper/2412.15750"},"observation_digest":"sha256:825a834935a17615b7dcc53a35e8d44a6550db7f50efa631263489dfff3065a0","observation_id":"0e75e75f-8280-42d0-af80-4d9fcdd79c3e","resolution":{"observed_at":"2026-08-11T11:12:58.155851Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.15750","last_updated":"2024-12-20T10:11:44Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T11:05:45.723034Z","submitted_at":"2024-12-20T10:11:44Z","title":"Extracting Interpretable Task-Specific Circuits from Large Language Models for Faster Inference"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2412.15750."}