{"as_of":"2026-08-11T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8af5fae4e882767dcd6d59a841914a2d49a3e7c50f03e3d7f33a65488285992a","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:43:14.801525Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:59:30.298880Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T18:59:33.160545Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"cited_work":{"arxiv_id":"2501.15054","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.15054","snapshot_observed_at":"2026-08-06T18:59:33.160545Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","venue":"cs.CL","work_id":"f77d2d5d-b8c8-4e2d-bc29-7b8a788230a5","year":2025},"citing_paper":{"arxiv_id":"2507.06722","last_updated":"2026-06-26T07:52:11Z","snapshot_observed_at":"2026-08-07T07:49:47.567466Z","submitted_at":"2025-07-09T10:30:09Z","title":"On the Effect of Uncertainty on Layer-wise Inference Dynamics","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T18:59:30.298880Z"},"links":{"cited_paper":"/paper/2501.15054","citing_paper":"/paper/2507.06722"},"observation_digest":"sha256:9b40317dca2787cc975086831845b15b8cdeea43e26fa4f026535c914220412f","observation_id":"43b03796-5d94-4077-addf-bed3abaabb52","resolution":{"observed_at":"2026-08-06T18:59:33.273968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15054/citation-record","integrity":"/paper/2501.15054/integrity","json":"/paper/2501.15054/citation-record.json","paper":"/paper/2501.15054"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.082409Z","title":"Neel Nanda","venue":null,"work_id":"19c52e33-3cdc-4b4f-b074-091a954e9ad7","year":2022},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.715218Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:233ff57a3ac09d8b72e80ea79ac628fa620b7e9d7436fab6724199959578de66","observation_id":"c1f030de-aa82-4686-8c78-12fe3ae90242","resolution":{"observed_at":"2026-08-10T14:43:15.086106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.049500Z","title":"A review of taxonomies of explainable artificial intelligence (xai) methods","venue":null,"work_id":"c5f4f3eb-4df4-4a13-9e95-0e5670fb51fb","year":2022},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.726295Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c5ec0b2a473176d196eae508f9c0a3dfeb92d5df1972beb8ce3216b1e1b184b9","observation_id":"268e257b-7345-4887-b610-8562bc4a4508","resolution":{"observed_at":"2026-08-10T14:43:15.053253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-10T14:43:14.729779Z","title":"Mechanistic interpretability for ai safety–a review.arXiv preprint arXiv:2404.14082,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.729779Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:373b166782223f093bebb473874fdfb3ddbe172ea93aab29e1867d0747070c00","observation_id":"6729c272-5017-4a3e-9ebd-bec9fcd2f384","resolution":{"observed_at":"2026-08-10T14:43:14.729779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-10T14:43:14.741505Z","title":"Sparse autoen- coders find highly interpretable features in language models.arXiv preprint arXiv:2309.08600,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.741505Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:103eadbccb5efdbd0eca305609204c888cb4b7153b9355fb48836f246091d59a","observation_id":"5d45590e-84b4-42de-b444-628aa8166c6b","resolution":{"observed_at":"2026-08-10T14:43:14.741505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-10T14:43:14.745081Z","title":"Inter- pretability in the wild: a circuit for indirect object identification in gpt-2 small.arXiv preprint arXiv:2211.00593,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.745081Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:3b132da4133cde0ba9c6e985fc1751263ac4346004c1f4e118de282ab0a85484","observation_id":"2ac73ebc-e5f0-4645-b3e4-e0a97897b17c","resolution":{"observed_at":"2026-08-10T14:43:14.745081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05969","last_updated":"2023-05-16T16:24:55Z","snapshot_observed_at":"2026-08-06T15:07:58.170997Z","submitted_at":"2023-04-12T16:46:43Z","title":"Localizing Model Behavior with Path Patching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05969","snapshot_observed_at":"2026-08-10T14:43:14.748803Z","title":"Localizing model behavior with path patching.arXiv preprint arXiv:2304.05969,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.748803Z"},"links":{"cited_paper":"/paper/2304.05969","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:310ec503f25110e1114de4e7c9b3a78053332f6998650799e952ff93f4c403e3","observation_id":"810515a5-3cf0-4547-ab2a-799b453335be","resolution":{"observed_at":"2026-08-10T14:43:14.748803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.036261Z","title":"com/posts/AcKRB8wDpdaN6v6ru/interpreting-gpt-the-logit-lens","venue":null,"work_id":"e4726f6b-9872-4c51-b57e-2a63bea05e9c","year":2019},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.752451Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:aae6b63c4beecb64ec3978e641b2c8bcd5a2803f0a89bde0ff03eebbcff32b82","observation_id":"81f2b69b-d54c-4439-b631-24a4305e28c3","resolution":{"observed_at":"2026-08-10T14:43:15.041894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00175","last_updated":"2023-06-30T23:44:51Z","snapshot_observed_at":"2026-07-06T15:49:03.353416Z","submitted_at":"2023-06-30T23:44:51Z","title":"Still No Lie Detector for Language Models: Probing Empirical and Conceptual Roadblocks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00175","snapshot_observed_at":"2026-08-10T14:43:14.759786Z","title":"URL http://arxiv.org/abs/2307.00175","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.759786Z"},"links":{"cited_paper":"/paper/2307.00175","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:ff68ded2b39c0b1462ed799d77200a30fbb6cbaa930171a91c775d6dbcd850a7","observation_id":"fc23120f-5abd-491a-84ea-8dcc3276034f","resolution":{"observed_at":"2026-08-10T14:43:14.759786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13382","last_updated":"2024-06-26T14:27:49Z","snapshot_observed_at":"2026-08-09T03:25:38.596456Z","submitted_at":"2022-10-24T16:29:55Z","title":"Emergent World Representations: Exploring a Sequence Model Trained on a Synthetic Task","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13382","snapshot_observed_at":"2026-08-10T14:43:14.763946Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.763946Z"},"links":{"cited_paper":"/paper/2210.13382","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:58a50554d3ea72d10885e5d0fb353b7a85ce4cf61dd363b831ef610694cf87e0","observation_id":"c8ba1d4b-b0f9-4cae-a9da-d4d1ec3d2dab","resolution":{"observed_at":"2026-08-10T14:43:14.763946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-10T14:43:14.768096Z","title":"URLhttp://arxiv.org/abs/2206.07682","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.768096Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:9b12b0ba6b78371de15a883dbd37e23277b50a1d160aa209845f8da785d367e4","observation_id":"c7759ce2-4653-44f3-960e-f793910915cc","resolution":{"observed_at":"2026-08-10T14:43:14.768096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-10T14:43:14.771573Z","title":"URLhttp://arxiv.org/abs/2301.05217","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.771573Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:88b13a115870ee5c1c2e525397e94904934db413e7533d7e40c3af22ea110669","observation_id":"708a0b8d-41c3-4d26-896f-e0fd0c4471ad","resolution":{"observed_at":"2026-08-10T14:43:14.771573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.08799","last_updated":"2023-01-15T21:53:00Z","snapshot_observed_at":"2026-08-10T04:33:41.770371Z","submitted_at":"2022-07-18T17:55:05Z","title":"Hidden Progress in Deep Learning: SGD Learns Parities Near the Computational Limit","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.08799","snapshot_observed_at":"2026-08-10T14:43:14.775196Z","title":"URLhttp://arxiv.org/abs/2207.08799","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.775196Z"},"links":{"cited_paper":"/paper/2207.08799","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:65be98481f2af9b5dbc3aaf46917e434d7b1fd88043d8aa3d2039ead1e0ed7f4","observation_id":"4382c841-0db5-4bfa-9031-dfca2a9091ca","resolution":{"observed_at":"2026-08-10T14:43:14.775196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05262","last_updated":"2023-01-13T15:16:16Z","snapshot_observed_at":"2026-07-06T12:36:34.388460Z","submitted_at":"2022-02-10T18:59:54Z","title":"Locating and Editing Factual Associations in GPT","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05262","snapshot_observed_at":"2026-08-10T14:43:14.779216Z","title":"URL http://arxiv.org/ abs/2202.05262","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.779216Z"},"links":{"cited_paper":"/paper/2202.05262","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:24e06fc184b3fe30e8e67054aad387ee919a429946f06a3f531b785b3c0f7b55","observation_id":"e8a802a3-b2a4-4638-a89a-146c3af9cfb7","resolution":{"observed_at":"2026-08-10T14:43:14.779216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.02299","last_updated":"2024-09-17T11:55:58Z","snapshot_observed_at":"2026-08-02T02:19:01.218373Z","submitted_at":"2022-09-06T08:51:53Z","title":"A Survey of Machine Unlearning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.02299","snapshot_observed_at":"2026-08-10T14:43:14.782996Z","title":"URLhttp://arxiv.org/abs/2209.02299","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.782996Z"},"links":{"cited_paper":"/paper/2209.02299","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:d62b15738f3c238257f9d7603fb44f4686f07737bfe38512816664c1f550c7b9","observation_id":"860676fe-f804-4626-9fbf-632dacd16e3a","resolution":{"observed_at":"2026-08-10T14:43:14.782996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11415","last_updated":"2022-12-21T23:52:42Z","snapshot_observed_at":"2026-08-05T22:06:40.113719Z","submitted_at":"2022-12-21T23:52:42Z","title":"Circumventing interpretability: How to defeat mind-readers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11415","snapshot_observed_at":"2026-08-10T14:43:14.786443Z","title":"URLhttps://arxiv.org/abs/2212.11415","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.786443Z"},"links":{"cited_paper":"/paper/2212.11415","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:04252b9ab9463c43921df62fc20ce8b07ae114c734d13f9d303c3acad1bcb7d5","observation_id":"80f97076-180f-4218-8226-8aef73db19aa","resolution":{"observed_at":"2026-08-10T14:43:14.786443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-10T11:37:23.229129Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-10T14:43:14.789971Z","title":"Andy Zou, Long Phan, Sarah Chen, James Campbell, Phillip Guo, Richard Ren, Alexander Pan, Xuwang Yin, Mantas Mazeika, Ann-Kathrin Dombrowski, Shashwat Goel, Nathaniel Li, Michael J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.789971Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:71ad0abd7f00afa4e3838e215e07e52e830be89b6d608f5b1f670d47c8cd1dd3","observation_id":"8fee2dd8-deeb-431c-ac2d-e6ecb3d8d85e","resolution":{"observed_at":"2026-08-10T14:43:14.789971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-10T14:43:14.793410Z","title":"URL http://arxiv.org/ abs/2310.01405","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.793410Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:16d5a191398660bb92c44ff8c5fd8a2360f8358aa978c996d12245f156cde7d4","observation_id":"599be8c9-332f-4cc9-b99f-d2ca329015c0","resolution":{"observed_at":"2026-08-10T14:43:14.793410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-03T04:49:54.588813Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-10T14:43:14.797897Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.797897Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:d4a72c3b3868d4614e16cebc76fe16ea15ba98856955cfbd42dc71d6cf0f659a","observation_id":"85c92d42-2d8c-43e8-9bf8-053b56e0a0dc","resolution":{"observed_at":"2026-08-10T14:43:14.797897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07532","last_updated":"2020-12-04T22:53:18Z","snapshot_observed_at":"2026-07-06T10:24:12.354087Z","submitted_at":"2020-12-04T22:53:18Z","title":"An overview of 11 proposals for building safe advanced AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07532","snapshot_observed_at":"2026-08-10T14:43:14.801525Z","title":"URLhttp://arxiv.org/abs/2012.07532","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.801525Z"},"links":{"cited_paper":"/paper/2012.07532","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:4991bc2dc10050e254263edcb850ef9701d69d6e3252544a3bd65f5dd7aa14aa","observation_id":"d41b6da4-6911-4cac-9ea4-44a829bda27e","resolution":{"observed_at":"2026-08-10T14:43:14.801525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.060476Z","title":"Neel Nanda","venue":null,"work_id":"8459184c-aa90-45e6-9a28-2b0d985eba84","year":2018},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.722546Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:585cb5bbb430442211ed7f8a5d28e3e232fa98cc626dc08066f056db007875ea","observation_id":"cefe1f41-dc8d-4d9e-adfa-8be2419a5485","resolution":{"observed_at":"2026-08-10T14:43:15.064000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16367","last_updated":"2025-03-16T05:23:12Z","snapshot_observed_at":"2026-08-10T03:59:40.319371Z","submitted_at":"2024-04-25T07:10:29Z","title":"Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16367","snapshot_observed_at":"2026-08-10T14:43:14.756025Z","title":"Learning syntax without planting trees: Understanding when and why transformers generalize hierarchically.arXiv preprint arXiv:2404.16367,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.756025Z"},"links":{"cited_paper":"/paper/2404.16367","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:5d46f481d5143d19157e54543c54ac3fda4a648822aa2de209e881c252c0cbbe","observation_id":"6f5ceadc-785c-4c56-9ca3-dcfbfba038f4","resolution":{"observed_at":"2026-08-10T14:43:14.756025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:15.071280Z","title":"Lee Sharkey, Sid Black, and beren","venue":null,"work_id":"5797a51a-5d33-48f8-b604-c28165d1e3c9","year":2020},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.718935Z"},"links":{"citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:c5a82bfae3d785cd5716af275bceb0674c0d8beff73ae799fa12f93d79c5c120","observation_id":"a2552a8a-796f-4dd6-bef8-6f489b7c0018","resolution":{"observed_at":"2026-08-10T14:43:15.074738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-10T14:43:14.733628Z","title":"Understanding intermediate layers using linear classifier probes.arXiv preprint arXiv:1610.01644,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.733628Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:78d052b36171ec37528dd8cda43a6144254f31c4e0262462b09ff24e19a0e7b1","observation_id":"9015422d-b7ad-4ce4-8101-07aa05a192a1","resolution":{"observed_at":"2026-08-10T14:43:14.733628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05862","last_updated":"2022-09-20T16:49:56Z","snapshot_observed_at":"2026-08-10T17:14:06.401883Z","submitted_at":"2022-06-13T00:22:50Z","title":"X-Risk Analysis for AI Research","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05862","snapshot_observed_at":"2026-08-10T14:43:14.702248Z","title":"Dan Hendrycks, Mantas Mazeika, and Thomas Woodside","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.702248Z"},"links":{"cited_paper":"/paper/2206.05862","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:70b9103f6c95451ced3e701a795b48e395edd4dad717cda6b00469c8f8c0eef1","observation_id":"d45d8511-7f54-48d9-be16-a96a4dc080de","resolution":{"observed_at":"2026-08-10T14:43:14.702248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12001","last_updated":"2023-10-09T22:57:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-21T03:35:06Z","title":"An Overview of Catastrophic AI Risks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12001","snapshot_observed_at":"2026-08-10T14:43:14.706872Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.706872Z"},"links":{"cited_paper":"/paper/2306.12001","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:54876768f256fa8bc9c406f1a9f92411250bd96a67515329c42577ea024f8a7d","observation_id":"fa06af59-535d-40a7-a8f9-58b83639b142","resolution":{"observed_at":"2026-08-10T14:43:14.706872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19852","last_updated":"2025-04-04T11:14:49Z","snapshot_observed_at":"2026-08-05T20:02:35.087707Z","submitted_at":"2023-10-30T15:52:15Z","title":"AI Alignment: A Comprehensive Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19852","snapshot_observed_at":"2026-08-10T14:43:14.711050Z","title":"URLhttp://arxiv.org/abs/2310.19852","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.711050Z"},"links":{"cited_paper":"/paper/2310.19852","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:05e8c14bb0c0b6cb846f863f2306a407c261acfa57056e7e022358637f1ae28e","observation_id":"d51a07f8-32d9-4b56-a357-a4e17aba6e6f","resolution":{"observed_at":"2026-08-10T14:43:14.711050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T14:37:57.620121Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2501.15054."}