{"as_of":"2026-08-07T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f31a4e77673d75cd2e60b3c8fcdc0a05108aaa51a304d713c4401adacb570e03","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:03:05.057467Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.20040/citation-record","integrity":"/paper/2506.20040/integrity","json":"/paper/2506.20040/citation-record.json","paper":"/paper/2506.20040"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-emnlp.502","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.142193Z","title":"doi: 10.18653/v1/2022.findings-emnlp.502","venue":null,"work_id":"15ebf4d7-d226-4083-88fc-74fbb0590048","year":2022},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.897720Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:92b71619318297c0e75fb551eaa07038dde90ec8d30736331ec8f0b50f042740","observation_id":"d3d50ae8-98ca-4243-a7c7-5fcda11711ed","resolution":{"observed_at":"2026-08-06T23:03:05.147162Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.909942Z","title":"doi: 10.18653/v1/2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.909942Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:9dd58e2e5db94f79cb6f3e49f13bd2767a6277fa83889533cabf4a146e7c3230","observation_id":"8cdf66a4-7f18-4d13-8536-f7b6b6b189a6","resolution":{"observed_at":"2026-08-06T23:03:04.909942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.714812Z","title":"decent imitation of Brando’s godfather","venue":null,"work_id":"3abbf724-3650-4e1c-b72d-05ec9fc911c4","year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.057467Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:887bcaab36874a398d27ddb66d52beed80eb59aa57426aaf6b35841a30d96810","observation_id":"aee56bc2-ee28-4bda-9f7f-df24fe336b22","resolution":{"observed_at":"2026-08-06T23:03:05.718868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.933145Z","title":"Amirata Ghorbani, James Wexler, James Zou, and Been Kim","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.933145Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:238f31a3b68230f045b89470198e1afa3178e44f876919f0517ef5abc6d3140e","observation_id":"deb2ae37-d40e-47ed-8851-17c6f13dec6e","resolution":{"observed_at":"2026-08-06T23:03:04.933145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.03129","last_updated":"2019-10-08T09:28:43Z","snapshot_observed_at":"2026-08-05T21:24:52.219584Z","submitted_at":"2019-02-07T03:18:54Z","title":"Towards Automatic Concept-based Explanations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.03129","snapshot_observed_at":"2026-08-06T23:03:04.936840Z","title":"Antonio Gulli","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.936840Z"},"links":{"cited_paper":"/paper/1902.03129","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:e9e036fe62d3a9abb64312a2a7fd3c0a7b783b13ece9a3f86f8a0038318c7f79","observation_id":"fc40a662-07bb-4bd0-af87-bc462d923daf","resolution":{"observed_at":"2026-08-06T23:03:04.936840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-02T17:50:59.894886Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-06T23:03:04.944808Z","title":"Muhammad Umair Haider, Hammad Rizwan, Hassan Sajjad, Peizhong Ju, and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.944808Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:4a8266435fc61c44a8a1c386be7bdbf665cfc390c3ae5ea27ff2b5d16a5ad86e","observation_id":"599725ac-c13c-40aa-b525-a83d1e2d9e05","resolution":{"observed_at":"2026-08-06T23:03:04.944808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06809","last_updated":"2026-04-10T17:29:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T03:33:55Z","title":"Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution","version":3},"cited_work":{"arxiv_id":"2502.06809","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06809","snapshot_observed_at":"2026-08-06T23:03:05.578791Z","title":"Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution","venue":"cs.LG","work_id":"f5cbaf8d-1003-49be-8714-872bb7c106a1","year":2025},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.949338Z"},"links":{"cited_paper":"/paper/2502.06809","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:681ba6501fefd004b80ccb00e435da04a5fd0001ba86f2e5f8635577562c9dec","observation_id":"7351b938-812e-449f-936a-644a374d7a3b","resolution":{"observed_at":"2026-08-06T23:03:05.582839Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.953364Z","title":"doi: 10.18653/v1/ 2020.emnlp-main.53","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.953364Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:d9382b1471abcf2b61a8a652a0152063d7afae1c7a0c788c36d4488602b0f862","observation_id":"b8a241e5-5b50-48b9-8d5e-2351822a0e06","resolution":{"observed_at":"2026-08-06T23:03:04.953364Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11718","last_updated":"2023-05-19T14:56:05Z","snapshot_observed_at":"2026-07-06T15:29:43.160744Z","submitted_at":"2023-05-19T14:56:05Z","title":"Towards Accurate Image Coding: Improved Autoregressive Image Generation with Dynamic Vector Quantization","version":1},"cited_work":{"arxiv_id":"2305.11718","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.11718","snapshot_observed_at":"2026-08-06T23:03:05.563792Z","title":"Towards Accurate Image Coding: Improved Autoregressive Image Generation with Dynamic Vector Quantization","venue":"cs.CV","work_id":"667bca92-7fa8-4797-b7ca-912f50fe087f","year":2023},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.957053Z"},"links":{"cited_paper":"/paper/2305.11718","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:d9caf397b4a27c3ca9c8339a56359408721340e97973ecc8d91d256dc1e9a012","observation_id":"a3472575-ed4e-45ab-bc49-c9ca11558bd8","resolution":{"observed_at":"2026-08-06T23:03:05.567812Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06754","last_updated":"2023-05-14T14:38:41Z","snapshot_observed_at":"2026-07-06T15:25:59.314389Z","submitted_at":"2023-05-11T12:22:20Z","title":"COCKATIEL: COntinuous Concept ranKed ATtribution with Interpretable ELements for explaining neural net classifiers on NLP tasks","version":2},"cited_work":{"arxiv_id":"2305.06754","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.06754","snapshot_observed_at":"2026-08-06T23:03:05.538793Z","title":"COCKATIEL: COntinuous Concept ranKed ATtribution with Interpretable ELements for explaining neural net classifiers on NLP tasks","venue":"cs.CL","work_id":"7eaffb44-4f23-417a-b8e4-a1bc65469eef","year":2023},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.965111Z"},"links":{"cited_paper":"/paper/2305.06754","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:b68a1e11689232be17300aa85b7857adea1d12a46a4b49143c07e1f95a81c66c","observation_id":"4735bbed-f1c8-43ed-8207-8a3f23f34a31","resolution":{"observed_at":"2026-08-06T23:03:05.542995Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16681","last_updated":"2025-02-23T18:54:15Z","snapshot_observed_at":"2026-07-06T20:41:19.676815Z","submitted_at":"2025-02-23T18:54:15Z","title":"Are Sparse Autoencoders Useful? A Case Study in Sparse Probing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16681","snapshot_observed_at":"2026-08-06T23:03:04.969024Z","title":"Andrei Kapishnikov, Subhashini Venugopalan, Besim Avci, Ben Wedin, Michael Terry, and Tolga Bolukbasi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.969024Z"},"links":{"cited_paper":"/paper/2502.16681","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:2c5a24fb78abf2f77062b3d210c793d3b4ade92159d6057fb2c4c5922ad70459","observation_id":"d1d05748-dbe8-4555-92b9-b0b5554f5658","resolution":{"observed_at":"2026-08-06T23:03:04.969024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09788","last_updated":"2021-06-17T20:00:55Z","snapshot_observed_at":"2026-07-06T11:20:29.182280Z","submitted_at":"2021-06-17T20:00:55Z","title":"Guided Integrated Gradients: An Adaptive Path Method for Removing Noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09788","snapshot_observed_at":"2026-08-06T23:03:04.972742Z","title":"Been Kim, Martin Wattenberg, Justin Gilmer, Carrie Cai, James Wexler, Fernanda Viegas, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.972742Z"},"links":{"cited_paper":"/paper/2106.09788","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:3dcf2483cfe70094746460d191e2fcc3c0fa6ef3522aa78e3a32e148353d3cc2","observation_id":"665507d5-3c8b-4fae-991d-a7330aac22b3","resolution":{"observed_at":"2026-08-06T23:03:04.972742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04153","last_updated":"2023-06-19T17:37:02Z","snapshot_observed_at":"2026-08-04T12:55:02.428314Z","submitted_at":"2022-07-08T23:15:26Z","title":"Probing Classifiers are Unreliable for Concept Removal and Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04153","snapshot_observed_at":"2026-08-06T23:03:04.976946Z","title":"Michael Lan, Philip Torr, Austin Meek, Ashkan Khakzar, David Krueger, and Fazl Barez","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.976946Z"},"links":{"cited_paper":"/paper/2207.04153","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:41d9b415ee152be58ff48e31e4966a0502afbbfbcbe72dc81b51b950bcf20183","observation_id":"3d487363-e1ce-434e-87ca-54783cf66f70","resolution":{"observed_at":"2026-08-06T23:03:04.976946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06981","last_updated":"2025-05-21T00:01:46Z","snapshot_observed_at":"2026-08-04T17:40:02.230580Z","submitted_at":"2024-10-09T15:18:57Z","title":"Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06981","snapshot_observed_at":"2026-08-06T23:03:04.980730Z","title":"Daniil Laptev, Nikita Balagansky, Yaroslav Aksenov, and Daniil Gavrilov","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.980730Z"},"links":{"cited_paper":"/paper/2410.06981","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:d837f64bd434058ede34ab9c3c20dae93bcfb0f58be368b2827ce0d83aa39885","observation_id":"46b16aba-c31e-47e2-8109-3c704d83b256","resolution":{"observed_at":"2026-08-06T23:03:04.980730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03032","last_updated":"2025-07-24T21:16:27Z","snapshot_observed_at":"2026-07-06T20:31:27.068979Z","submitted_at":"2025-02-05T09:39:34Z","title":"Analyze Feature Flow to Enhance Interpretation and Steering in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03032","snapshot_observed_at":"2026-08-06T23:03:04.984298Z","title":"Jack Lindsey, Adly Templeton, Jonathan Marcus, Tom Conerly, Joshua Batson, and Chris Olah","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.984298Z"},"links":{"cited_paper":"/paper/2502.03032","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:36b1721069a3683da965a02414ad9729fd344fa8cd1e7addafa9dabf3fbbb3e7","observation_id":"99c2055d-f6ed-4653-a0f4-30634d1cf8bd","resolution":{"observed_at":"2026-08-06T23:03:04.984298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T23:03:04.988032Z","title":"12 Preprint","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.988032Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:c9c36f10dbfcb239bc253fe36ef4c1a505fb60ebcce314f076b9319727aa1692","observation_id":"b92e2c1d-a605-4e50-8be7-7ba135d04125","resolution":{"observed_at":"2026-08-06T23:03:04.988032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.995205Z","title":"Bo Pang and Lillian Lee","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.995205Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:2610b7cc3024d7d5e9245a27e899db29fe8cad2d429b26fd3e9d310a37ebf52b","observation_id":"5e2af7c8-4ed2-423d-a9f6-67ff3d5603e5","resolution":{"observed_at":"2026-08-06T23:03:04.995205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16615","last_updated":"2025-01-29T19:18:45Z","snapshot_observed_at":"2026-07-06T20:27:09.296190Z","submitted_at":"2025-01-28T01:24:16Z","title":"Sparse Autoencoders Trained on the Same Data Learn Different Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16615","snapshot_observed_at":"2026-08-06T23:03:05.002183Z","title":"Dheeraj Rajagopal, Vidhisha Balachandran, Eduard H Hovy, and Yulia Tsvetkov","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.002183Z"},"links":{"cited_paper":"/paper/2501.16615","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:cf44fd4fb2fbcf83c6a9b2f61253d5e5ea0a73f619f951546dbf2ab4f0b71ac0","observation_id":"dc209aea-5f78-4784-8b2b-721e8c69e9c1","resolution":{"observed_at":"2026-08-06T23:03:05.002183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.006285Z","title":"doi: 10.18653/v1/2021.emnlp-main.64","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.006285Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:2f7f3b41d09fade0a8d7c66aedc10470320c476c1f8844bff6b3573212c102bd","observation_id":"1afb8e3a-5eb7-428b-8a03-b09e8b6e24ef","resolution":{"observed_at":"2026-08-06T23:03:05.006285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00446","last_updated":"2019-06-02T16:46:42Z","snapshot_observed_at":"2026-08-04T16:17:18.141333Z","submitted_at":"2019-06-02T16:46:42Z","title":"Generating Diverse High-Fidelity Images with VQ-VAE-2","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00446","snapshot_observed_at":"2026-08-06T23:03:05.010183Z","title":"Hassan Sajjad, Nadir Durrani, and Fahim Dalvi","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.010183Z"},"links":{"cited_paper":"/paper/1906.00446","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:e5a2e6b04ef2faf62c4baadfbc0bdf46711c43a48264f7c1d99ee9199cbdda05","observation_id":"67f057d8-38a5-49b4-a88d-e555b7c9349f","resolution":{"observed_at":"2026-08-06T23:03:05.010183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.013923Z","title":"doi: 10.18653/v1/2021.acl-long.330","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.013923Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:b538b1f7129b1ee252d00aaf844c70e09ba214a24fcba8667d9596927f680f30","observation_id":"934c6255-4e59-4e9d-b7e3-5f9fe6f66e22","resolution":{"observed_at":"2026-08-06T23:03:05.013923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08200","last_updated":"2025-05-23T03:46:43Z","snapshot_observed_at":"2026-08-03T01:01:56.423658Z","submitted_at":"2025-03-11T09:08:07Z","title":"Route Sparse Autoencoder to Interpret Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08200","snapshot_observed_at":"2026-08-06T23:03:05.017328Z","title":"13 Preprint","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.017328Z"},"links":{"cited_paper":"/paper/2503.08200","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:6f460523ce3c28790adc017157e88ff472f9023426522f5e7eccc490cf6bb45c","observation_id":"03f06d63-170e-40bb-b0be-dfa40c32aadc","resolution":{"observed_at":"2026-08-06T23:03:05.017328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01365","last_updated":"2017-06-13T01:52:38Z","snapshot_observed_at":"2026-07-06T05:32:18.507883Z","submitted_at":"2017-03-04T00:18:49Z","title":"Axiomatic Attribution for Deep Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01365","snapshot_observed_at":"2026-08-06T23:03:05.021086Z","title":"Yuhta Takida, Takashi Shibuya, WeiHsiang Liao, Chieh-Hsin Lai, Junki Ohmura, Toshimitsu Uesaka, Naoki Murata, Shusuke Takahashi, Toshiyuki Kumakura, and Yuki Mitsufuji","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.021086Z"},"links":{"cited_paper":"/paper/1703.01365","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:33100caea40b2e9dc18054b3eb3603b0fb5883d795536a7afab2ee2d8507c40f","observation_id":"e5980970-bd2c-482c-8829-68233cbd5ac4","resolution":{"observed_at":"2026-08-06T23:03:05.021086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.07547","last_updated":"2022-06-09T12:46:05Z","snapshot_observed_at":"2026-07-06T13:10:16.795009Z","submitted_at":"2022-05-16T09:49:37Z","title":"SQ-VAE: Variational Bayes on Discrete Representation with Self-annealed Stochastic Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.07547","snapshot_observed_at":"2026-08-06T23:03:05.024809Z","title":"Transformer Circuits Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.024809Z"},"links":{"cited_paper":"/paper/2205.07547","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:c264b1e36195f1e5375c51f96bca1334c5ffeda231c5b5deea8a71d316677cfb","observation_id":"07849fbc-9532-481c-8ce3-3961e4ecac45","resolution":{"observed_at":"2026-08-06T23:03:05.024809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:03:05.032055Z","title":"Aaron van den Oord, Oriol Vinyals, and Koray Kavukcuoglu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.032055Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:daaddd36c67d41259b91c6253b4ee63c773b08bb6cf40359c71db52e79f036a4","observation_id":"0c936fcf-e240-4175-adea-942c2cbe0f87","resolution":{"observed_at":"2026-08-06T23:03:05.032055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.04629","last_updated":"2019-03-04T11:50:21Z","snapshot_observed_at":"2026-07-06T06:49:50.420331Z","submitted_at":"2018-07-12T15:08:31Z","title":"Learning Product Codebooks using Vector Quantized Autoencoders for Image Retrieval","version":4},"cited_work":{"arxiv_id":"1807.04629","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.04629","snapshot_observed_at":"2026-08-06T23:03:05.192807Z","title":"Learning Product Codebooks using Vector Quantized Autoencoders for Image Retrieval","venue":"eess.IV","work_id":"b063891d-a7b0-48d5-bff8-d809375c3363","year":2018},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.039542Z"},"links":{"cited_paper":"/paper/1807.04629","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:068b16c454db78593e319d4c040ae73048fb1645e236e9897d68f2e67d7c4e67","observation_id":"a77e9f24-19bb-4703-96bf-b8cd0e2a64b6","resolution":{"observed_at":"2026-08-06T23:03:05.196889Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01203","last_updated":"2024-04-16T21:44:32Z","snapshot_observed_at":"2026-08-04T09:48:16.710383Z","submitted_at":"2024-02-02T08:13:18Z","title":"Neural Language of Thought Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01203","snapshot_observed_at":"2026-08-06T23:03:05.043151Z","title":"Xuemin Yu, Fahim Dalvi, Nadir Durrani, Marzia Nouri, and Hassan Sajjad","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.043151Z"},"links":{"cited_paper":"/paper/2402.01203","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:b18d5a2dc7dcc3bac9d9850acedc6c01c1129186ab389d7ef805a2889bbafac7","observation_id":"e6b581b2-ca51-4348-ab58-9adc80e57a79","resolution":{"observed_at":"2026-08-06T23:03:05.043151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12545","last_updated":"2024-10-07T19:12:38Z","snapshot_observed_at":"2026-08-06T18:36:02.667433Z","submitted_at":"2024-04-18T23:50:50Z","title":"Latent Concept-based Explanation of NLP Models","version":3},"cited_work":{"arxiv_id":"2404.12545","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.12545","snapshot_observed_at":"2026-08-06T23:03:05.167122Z","title":"Latent Concept-based Explanation of NLP Models","venue":"cs.CL","work_id":"085324c1-6d39-45db-920a-3501e4e33aa6","year":2024},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.046525Z"},"links":{"cited_paper":"/paper/2404.12545","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:d7e9a2f14943876fd9f50dee0204b7f3bcfcc7ee38a3e118c971bc88f4417cd9","observation_id":"d4faeb17-8dd6-464e-b242-ecd8f6921232","resolution":{"observed_at":"2026-08-06T23:03:05.172296Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.261","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.084664Z","title":"doi: 10.18653/v1/2023.acl-long.261","venue":null,"work_id":"7aaa807e-776a-4ec6-ad11-a44fd3b4c15b","year":2023},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.050199Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:2ad50f3fd95561e479253d3a7da87ff5fb522164fa155aacde1fd9602a685954","observation_id":"75068d2a-ce50-4cfe-966a-e5e795343bc5","resolution":{"observed_at":"2026-08-06T23:03:05.089680Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03382","last_updated":"2018-06-07T21:48:19Z","snapshot_observed_at":"2026-07-06T06:27:24.379369Z","submitted_at":"2018-03-09T04:39:35Z","title":"Fast Decoding in Sequence Models using Discrete Latent Variables","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03382","snapshot_observed_at":"2026-08-06T23:03:05.053666Z","title":"14 Preprint","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.053666Z"},"links":{"cited_paper":"/paper/1803.03382","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:366ce7b9a0081807f0ca46ee95a830251e85d5800fb6646e1d7a961335824d2c","observation_id":"1ce87d5d-48fa-4236-a20c-733c82d8ba9c","resolution":{"observed_at":"2026-08-06T23:03:05.053666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.998627Z","title":"doi: 10.3115/1218955.1218990","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.998627Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:b597220e274a53b114d7ded41983e45e795fac5da8fd6de703d4193b8358eed7","observation_id":"9576660a-07b4-4195-881b-0451f80e3e8b","resolution":{"observed_at":"2026-08-06T23:03:04.998627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.913961Z","title":"cjadams, Jeffrey Sorensen, Julia Elliott, Lucas Dixon, Mark McDonald, nithum, and Will Cukierski","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.913961Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:8d9809e174239b5b49cdbfce26eedcafc3716a5d726bd0843d0568741a6e0afe","observation_id":"710c00a5-e243-4205-be0b-8da5fcb944f3","resolution":{"observed_at":"2026-08-06T23:03:04.913961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.906187Z","title":"doi: 10.18653/v1/P17-1080","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.906187Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:73c42536d02c0d4f54fcb8b9220f9dc8d6403f937bb94d1a7f32dbe20c638d1a","observation_id":"b435be95-4660-4aac-a449-8420bc676709","resolution":{"observed_at":"2026-08-06T23:03:04.906187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00937","last_updated":"2018-05-30T14:58:27Z","snapshot_observed_at":"2026-08-01T14:58:21.912263Z","submitted_at":"2017-11-02T21:14:44Z","title":"Neural Discrete Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00937","snapshot_observed_at":"2026-08-06T23:03:05.035264Z","title":"Hanwei Wu and Markus Flierl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:05.035264Z"},"links":{"cited_paper":"/paper/1711.00937","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:d1ad73324dadcd27a6b546aa3a04452d0d2292b733811529a40fa59efcd4c273","observation_id":"40c8c547-2b74-463e-8ead-0bd5de8b7e6d","resolution":{"observed_at":"2026-08-06T23:03:05.035264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:04.921165Z","title":"doi: 10.18653/v1/N19-1423","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.921165Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:cc2c5da3743faa64e3f26d59aa9b6131080a820f0fa86d81057bfbcc305ee94a","observation_id":"6ff967f0-c91e-497b-96f5-88effd81a800","resolution":{"observed_at":"2026-08-06T23:03:04.921165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.08101","last_updated":"2020-06-15T02:59:52Z","snapshot_observed_at":"2026-07-06T09:29:02.782285Z","submitted_at":"2020-06-15T02:59:52Z","title":"Evidence-Aware Inferential Text Generation with Vector Quantised Variational AutoEncoder","version":1},"cited_work":{"arxiv_id":"2006.08101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.08101","snapshot_observed_at":"2026-08-06T23:03:05.602915Z","title":"Evidence-Aware Inferential Text Generation with Vector Quantised Variational AutoEncoder","venue":"cs.CL","work_id":"531a1606-81a5-4228-be2d-03676286c5e6","year":2020},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.940881Z"},"links":{"cited_paper":"/paper/2006.08101","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:5973721aa3a920d13f7eef482590b905fc04c3817460c9b1f3a15bbe178869e5","observation_id":"7829f2b2-109f-42ab-94e7-c1456cddb32c","resolution":{"observed_at":"2026-08-06T23:03:05.607465Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11944","last_updated":"2024-11-06T22:37:30Z","snapshot_observed_at":"2026-08-04T08:40:10.913790Z","submitted_at":"2024-06-17T17:49:00Z","title":"Transcoders Find Interpretable LLM Feature Circuits","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11944","snapshot_observed_at":"2026-08-06T23:03:04.924942Z","title":"doi: 10.18653/v1/ 2021.emnlp-main.98","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.924942Z"},"links":{"cited_paper":"/paper/2406.11944","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:bffe13f7d5e4fc6c96f2a395776367c23e82d1fc72a4671749eb6ba140ead308","observation_id":"28e4f11c-d675-4fef-b678-360e2fcb902d","resolution":{"observed_at":"2026-08-06T23:03:04.924942Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.736947Z","title":"David Arps, Younes Samih, Laura Kallmeyer, and Hassan Sajjad","venue":null,"work_id":"9ea69b40-25c3-4666-a465-bf12e98c8a0e","year":2022},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.893339Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:5126a95af30479b331cc1966aeedb042c520bad026e199272b5512a2e02ad235","observation_id":"e59ee0bc-1719-403e-98bd-d592de26c4bd","resolution":{"observed_at":"2026-08-06T23:03:05.740984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:03:05.726015Z","title":"Jacob Devlin, Ming-Wei Chang, Kenton Lee, and Kristina Toutanova","venue":null,"work_id":"2e814e4d-b5a6-4d49-820a-8949299363e8","year":2019},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.917807Z"},"links":{"citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:f6c8e8aea8215a7c4ace7447a8345832d5396b99616116f4c5486ce15a153180","observation_id":"7b6c3bbe-929f-4d4a-82ec-62ebc822445d","resolution":{"observed_at":"2026-08-06T23:03:05.729788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07122","last_updated":"2024-12-05T10:45:02Z","snapshot_observed_at":"2026-08-05T05:46:39.043271Z","submitted_at":"2024-11-11T16:51:39Z","title":"SCAR: Sparse Conditioned Autoencoders for Concept Detection and Steering in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07122","snapshot_observed_at":"2026-08-06T23:03:04.961135Z","title":"Fanny Jourdan, Agustin Picard, Thomas Fel, Laurent Risser, Jean Michel Loubes, and Nicholas Asher","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.961135Z"},"links":{"cited_paper":"/paper/2411.07122","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:28e955f2d96aee167d8049a987bb8f463b60f6bb6013f4a25d25963592567aa7","observation_id":"e7b33b1e-1ea3-44f6-bf43-bc8e6d06e626","resolution":{"observed_at":"2026-08-06T23:03:04.961135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07656","last_updated":"2025-03-01T07:16:47Z","snapshot_observed_at":"2026-07-06T19:30:56.585110Z","submitted_at":"2024-10-10T06:55:38Z","title":"Mechanistic Permutability: Match Features Across Layers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07656","snapshot_observed_at":"2026-08-06T23:03:04.901923Z","title":"Yonatan Belinkov, Nadir Durrani, Fahim Dalvi, Hassan Sajjad, and James Glass","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:03:04.901923Z"},"links":{"cited_paper":"/paper/2410.07656","citing_paper":"/paper/2506.20040"},"observation_digest":"sha256:297f046974f18a04c1537a25ef594b73bd16fd805395458835756943a00ebea1","observation_id":"b979b11a-46c6-4021-ac60-6fefe145af61","resolution":{"observed_at":"2026-08-06T23:03:04.901923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.20040","last_updated":"2026-06-09T21:19:14Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T22:55:38.353499Z","submitted_at":"2025-06-24T22:43:36Z","title":"Cross-Layer Discrete Concept Discovery for Interpreting Language Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":2,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":28,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2506.20040."}