{"as_of":"2026-08-08T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cef1beeb2e895f0ab1d5ffc0836ffd5e4e7b19a1f423dbaf00e017425cd661c5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":37,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:08:02.254996Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-07T23:08:02.254996Z","title":"J., Liao, I., Gurnee, W., and Tegmark, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-07T22:55:15.992320Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.254996Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:216ae4926f70819167d2e8d365172f11b7c5146f207d9e8d77da7f099d66b1f5","observation_id":"da61c799-cd6e-46da-bef2-457e7d73ce2e","resolution":{"observed_at":"2026-08-07T23:08:02.254996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-07T13:28:00.819179Z","title":"J., Gurnee, W., and Tegmark, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21800","last_updated":"2025-05-27T22:14:54Z","snapshot_observed_at":"2026-08-08T06:26:51.645442Z","submitted_at":"2025-05-27T22:14:54Z","title":"From Directions to Cones: Exploring Multidimensional Representations of Propositional Facts in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:28:00.819179Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2505.21800"},"observation_digest":"sha256:d881af4869e1666b5b9e885b820f2b1adf01b74ba620c7a7a127578b8c36ffce","observation_id":"44a87f73-8562-4a2b-98f8-8fb523dc1847","resolution":{"observed_at":"2026-08-07T13:28:00.819179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-07T13:11:10.172162Z","title":"Not all language model features are one-dimensionally linear,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22506","last_updated":"2025-05-28T15:54:33Z","snapshot_observed_at":"2026-08-07T13:03:14.367525Z","submitted_at":"2025-05-28T15:54:33Z","title":"Sparsification and Reconstruction from the Perspective of Representation Geometry","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:10.172162Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2505.22506"},"observation_digest":"sha256:a44806b2ac6089a2ec021896e770d36b2cda9464a727e2dc56bc54f5702fbb1f","observation_id":"b3f89a17-2f54-4b91-b149-3593b7a074d4","resolution":{"observed_at":"2026-08-07T13:11:10.172162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-07T11:56:15.166919Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01197","last_updated":"2025-06-01T22:20:07Z","snapshot_observed_at":"2026-08-08T00:38:29.378844Z","submitted_at":"2025-06-01T22:20:07Z","title":"Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:15.166919Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2506.01197"},"observation_digest":"sha256:09dd71f77235bbbca59200eb9019734022d35ad787fc5c44109717c9a10ecc68","observation_id":"da87d8a2-5ba9-4978-81d9-3c72e69790c1","resolution":{"observed_at":"2026-08-07T11:56:15.166919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-06T17:17:28.984932Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11316","last_updated":"2025-07-15T13:48:35Z","snapshot_observed_at":"2026-08-08T00:39:39.784862Z","submitted_at":"2025-07-15T13:48:35Z","title":"Internal Value Alignment in Large Language Models through Controlled Value Vector Activation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:17:28.984932Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2507.11316"},"observation_digest":"sha256:40067198df4f06f4e35eab719976c4554cc6f55f2ccf18fe1540a03ddffe4781","observation_id":"a2ef8bf8-f3bb-49ea-bc85-52577a1bc164","resolution":{"observed_at":"2026-08-06T17:17:28.984932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2601.19208","last_updated":"2026-05-12T21:37:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-27T05:22:34Z","title":"How Do Transformers Learn to Associate Tokens: Gradient Leading Terms Bring Mechanistic Interpretability","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T11:20:33.400885Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2601.19208"},"observation_digest":"sha256:d1ed58041777edd1ecae74560e76d175cebc8a05cc88b48f080cadb057086490","observation_id":"4cad7f70-6925-454b-84c0-1e076421cc8e","resolution":{"observed_at":"2026-05-16T11:20:52.634674Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-02T22:57:36.025860Z","title":"Shortcuts and identifiability in concept-based models from a neuro-symbolic lens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15438","last_updated":"2026-06-24T10:39:19Z","snapshot_observed_at":"2026-08-02T22:57:32.915381Z","submitted_at":"2026-02-17T09:00:56Z","title":"Logit Distance Bounds Representational Similarity","version":3},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-02T22:57:36.025860Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2602.15438"},"observation_digest":"sha256:43bd4e5d99e3695d53c0993a227a6b78b8c1680d8812f4f9ea3208c4e89abe31","observation_id":"caee3fe2-910b-4c01-a668-51ceeffa284f","resolution":{"observed_at":"2026-08-02T22:57:36.025860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2603.01227","last_updated":"2026-07-25T18:05:32Z","snapshot_observed_at":"2026-08-02T19:43:22.821778Z","submitted_at":"2026-03-01T18:42:59Z","title":"The Lattice Representation Hypothesis of Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T12:00:28.281826Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2603.01227"},"observation_digest":"sha256:89fa0043c9def5d1e25bf48e0faed9cfe362484e83c86e4688945ee4cbed20ac","observation_id":"b64c2577-70da-4c6d-aee8-65fc99871aa1","resolution":{"observed_at":"2026-05-21T12:04:09.560248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-02T19:43:25.400771Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.01227","last_updated":"2026-07-25T18:05:32Z","snapshot_observed_at":"2026-08-02T19:43:22.821778Z","submitted_at":"2026-03-01T18:42:59Z","title":"The Lattice Representation Hypothesis of Large Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T19:43:25.400771Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2603.01227"},"observation_digest":"sha256:b05e80639117a87ef43489203e8aaeb5eb585ed175df96e56b86814ca92cdcde","observation_id":"1401b968-426c-41ed-9981-730516cecf67","resolution":{"observed_at":"2026-08-02T19:43:25.400771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2604.15557","last_updated":"2026-04-16T22:18:59Z","snapshot_observed_at":"2026-07-06T23:03:02.938732Z","submitted_at":"2026-04-16T22:18:59Z","title":"Predicting Where Steering Vectors Succeed","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T10:59:30.755424Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2604.15557"},"observation_digest":"sha256:9615059745a9a635e27a4b271dd0aa5e0c648265fd4b35fd3d341e1863af2fbc","observation_id":"1971c98c-41e4-433a-b9eb-9d18adedf9b8","resolution":{"observed_at":"2026-05-10T11:00:03.823175Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2604.21691","last_updated":"2026-04-23T13:58:12Z","snapshot_observed_at":"2026-08-02T12:48:50.592713Z","submitted_at":"2026-04-23T13:58:12Z","title":"There Will Be a Scientific Theory of Deep Learning","version":1},"reference_index":217,"source":"arxiv_source","source_observed_at":"2026-05-09T20:11:17.616190Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2604.21691"},"observation_digest":"sha256:1e5f41878330017ae41beb33368c7f7b6a9c499be153f98265ff1374d8b5b804","observation_id":"c6473e49-605c-40b6-8393-ef777b005572","resolution":{"observed_at":"2026-05-11T15:21:09.121872Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.00847","last_updated":"2026-05-06T20:35:10Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-04-15T00:59:17Z","title":"H-Probes: Extracting Hierarchical Structures From Latent Representations of Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T14:07:36.656164Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.00847"},"observation_digest":"sha256:1a9d1fa6eda26a1f6178ae591dc7d6350b4212feb0c69ed8e451afd6f95eb743","observation_id":"fdb5656b-db9c-45e3-9f20-601071dc2f16","resolution":{"observed_at":"2026-05-10T14:10:28.842529Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.05115","last_updated":"2026-05-06T16:46:03Z","snapshot_observed_at":"2026-08-07T10:12:24.411121Z","submitted_at":"2026-05-06T16:46:03Z","title":"Manifold Steering Reveals the Shared Geometry of Neural Network Representation and Behavior","version":1},"reference_index":205,"source":"arxiv_source","source_observed_at":"2026-05-08T17:47:09.591001Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.05115"},"observation_digest":"sha256:a9f0fdfe182a2371c5937316f2625bacb5659fc670c8f95bdc276a560e2903bb","observation_id":"332ab266-1b4f-47a3-93f8-997d92b30daf","resolution":{"observed_at":"2026-05-11T17:16:06.969598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:58.543525Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:d78965bc95ede64409b20df5bb629905998abec308100e6df15f8fa3136b28a3","observation_id":"d7a541ed-ae90-49c3-b09f-74f8fa3620d5","resolution":{"observed_at":"2026-05-11T03:15:54.387341Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.07922","last_updated":"2026-05-11T02:18:14Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T15:57:37Z","title":"Tree SAE: Learning Hierarchical Feature Structures in Sparse Autoencoders","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:50.776347Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.07922"},"observation_digest":"sha256:a362214b27d75cc2d82f0deec645fa1d42a13babae2028a31df7e32b9887cafe","observation_id":"a57d3192-6627-4e4c-8f6b-b0834607e294","resolution":{"observed_at":"2026-05-12T07:16:25.371063Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.07990","last_updated":"2026-05-08T16:47:08Z","snapshot_observed_at":"2026-08-02T18:36:12.949377Z","submitted_at":"2026-05-08T16:47:08Z","title":"Tool Calling is Linearly Readable and Steerable in Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-11T03:09:11.013914Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.07990"},"observation_digest":"sha256:fe9e4b36326b5d6ac0d7b8a3ab8a3ac5cd6e0dd78cd10f52f92b5c544a535ec8","observation_id":"f78a01aa-39b5-4d40-ab9e-17cd95f9cd34","resolution":{"observed_at":"2026-05-11T03:10:52.721023Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.09967","last_updated":"2026-05-11T04:18:43Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T04:18:43Z","title":"Tensor Product Representation Probes Reveal Shared Structure Across Linear Directions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T03:31:40.195348Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.09967"},"observation_digest":"sha256:7769abdeaaffce5d8af2e61949918958214a31babbbe6809e6ae9a28a057a798","observation_id":"629d436a-31e6-4e78-a889-54c1723729ec","resolution":{"observed_at":"2026-05-12T07:16:30.298763Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-14T20:53:40.666929Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:84dbeb58dd5bdf4b98cdf00883abcd182608f849bedc7beb775e92d430f7e7ff","observation_id":"9bc12940-3a01-4c8c-8e36-5dcc4ce30711","resolution":{"observed_at":"2026-05-14T20:59:28.564457Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-15T04:59:11.877068Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:af9e2f5a3404da9bd98415e5e10d85adf90fbb021bc1b5cef1653214ae60ad62","observation_id":"0e9c5996-8459-4dac-9d93-5d79ffec6cdf","resolution":{"observed_at":"2026-05-15T04:59:45.200561Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:2fb40f8ebfc4bb90e8b3659e5a402d5cb43487cf8b24aee9b6ab0d1774ad3e0d","observation_id":"6bc4200b-a4f3-4338-9320-f39f80371e64","resolution":{"observed_at":"2026-05-21T07:49:50.100762Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.14075","last_updated":"2026-05-13T19:51:25Z","snapshot_observed_at":"2026-08-02T01:26:29.339562Z","submitted_at":"2026-05-13T19:51:25Z","title":"Rethinking Layer Relevance in Large Language Models Beyond Cosine Similarity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-15T05:05:01.099084Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.14075"},"observation_digest":"sha256:3a81405e2283b7272fd448ba7a3816d9fea0d5df57554e3e469a488bf22c7e83","observation_id":"383a1443-61e9-4889-b6b8-cbd31759d547","resolution":{"observed_at":"2026-05-15T05:09:46.256471Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.27970","last_updated":"2026-05-27T05:04:29Z","snapshot_observed_at":"2026-08-01T18:47:42.892145Z","submitted_at":"2026-05-27T05:04:29Z","title":"Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T12:31:21.660647Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.27970"},"observation_digest":"sha256:dbe791b24df62855d492f54ee95acb5e915a3df3f0dda9368413c600aab41080","observation_id":"7cf0129d-1f53-4d86-85b0-50bef9abe05b","resolution":{"observed_at":"2026-06-29T12:33:24.317059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T14:16:44.232080Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:428d731277239c4b408843caf40290bf06696f89f8ad73d531c661cde5043ba1","observation_id":"58141d5e-4aea-4be7-8f3c-c61e8ef479d1","resolution":{"observed_at":"2026-06-29T14:23:30.789091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-04T05:02:51.288089Z","title":"Michaud, Isaac Liao, Wes Gurnee, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.28149","last_updated":"2026-08-04T06:19:42Z","snapshot_observed_at":"2026-08-07T23:09:28.260788Z","submitted_at":"2026-05-27T08:31:43Z","title":"Sign-Aware Gated Sparse Autoencoders: Modeling Anticorrelated Features with Bi-Jump-ReLU Activations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T05:02:51.288089Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2605.28149"},"observation_digest":"sha256:efb113fb091d16c59b72604f5baf4e9f772148199cef412b8d300f161f3c5286","observation_id":"34173d6d-fdf3-4433-848d-c5ddf4e0862f","resolution":{"observed_at":"2026-08-04T05:02:51.288089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.05194","last_updated":"2026-07-08T19:54:16Z","snapshot_observed_at":"2026-08-06T06:51:53.907927Z","submitted_at":"2026-05-11T21:09:00Z","title":"Temporal Preference Concepts and their Functions in a Large Language Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T22:16:47.743387Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.05194"},"observation_digest":"sha256:5573152f60858355c6607c6fa0ae62f526cd5dac86a94df1a70db66a9fc5f6f4","observation_id":"e59b3cf3-c9b0-459a-8df8-a775b5f23dc1","resolution":{"observed_at":"2026-07-01T14:05:47.187058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-07-12T17:03:44.315006Z","title":"Michaud, Isaac Liao, Wes Gurnee, and Max Tegmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05194","last_updated":"2026-07-08T19:54:16Z","snapshot_observed_at":"2026-08-06T06:51:53.907927Z","submitted_at":"2026-05-11T21:09:00Z","title":"Temporal Preference Concepts and their Functions in a Large Language Model","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-12T17:03:44.315006Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.05194"},"observation_digest":"sha256:ecebc39d42935eef43d698c5cb450a5f75122c81c53081cd346b96e3ffea3f2e","observation_id":"1db4c80b-7165-4016-96cd-421e242dd481","resolution":{"observed_at":"2026-07-12T17:03:44.315006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.06333","last_updated":"2026-06-04T16:08:25Z","snapshot_observed_at":"2026-08-02T07:30:20.394633Z","submitted_at":"2026-06-04T16:08:25Z","title":"Subspace-Aware Sparse Autoencoders for Effective Mechanistic Interpretability","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T02:07:18.198225Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.06333"},"observation_digest":"sha256:fb212e70be49e2a77e35efed68ccbd5d3e676e50915c9a0127c5a305533f7772","observation_id":"05e3641c-e8cd-4b4f-a8cd-6ecc0c91b122","resolution":{"observed_at":"2026-06-28T02:11:29.085215Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.09607","last_updated":"2026-06-08T15:17:54Z","snapshot_observed_at":"2026-08-02T05:50:49.496750Z","submitted_at":"2026-06-08T15:17:54Z","title":"Closure-Validated Circuit Discovery in Attention Heads: Co-activation Proposes, Ablation Disposes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T17:19:27.706747Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.09607"},"observation_digest":"sha256:62d08b0b0fdc0d8efb98edafd1a24f96654e8017095e4f3a5788e5c458a1b3b3","observation_id":"4252f86c-9887-4d15-8bd0-7ade27ff6397","resolution":{"observed_at":"2026-07-03T00:17:29.333025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.09658","last_updated":"2026-06-08T15:42:54Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:42:54Z","title":"Muon Learns More Robust and Transferable Features than Adam","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-06-27T17:08:30.717799Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.09658"},"observation_digest":"sha256:58d76ebe7682fcf468247f8e95288baf61705f2c4793fd6bad0ea8798afdd66e","observation_id":"548f1b33-918c-4b0f-90f1-a7202210d2ca","resolution":{"observed_at":"2026-07-03T00:27:30.214165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.10198","last_updated":"2026-06-10T01:25:04Z","snapshot_observed_at":"2026-08-06T13:00:55.084223Z","submitted_at":"2026-06-08T21:36:12Z","title":"Density Ridge Selective Prediction for LLM and VLM Hallucination Detection under Calibration Label Scarcity","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T17:14:01.320643Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.10198"},"observation_digest":"sha256:3a009e16247c998ff433ef1656e01a07ea9db8490ea08bedb9b89e07d703ea38","observation_id":"c31441fa-cd1c-408f-b70e-46770a6a16db","resolution":{"observed_at":"2026-07-03T00:27:29.503504Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.15054","last_updated":"2026-06-29T22:04:02Z","snapshot_observed_at":"2026-08-03T01:16:15.417885Z","submitted_at":"2026-06-13T01:51:05Z","title":"Size Doesn't Matter: Cosine-Scored Sparse Autoencoders","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-01T07:15:16.674714Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.15054"},"observation_digest":"sha256:d59bfbdb4910c99f9d26b2d2e1c9e8460fc8029f1138574440841fbef7a2f1fd","observation_id":"bdb436bc-7722-4224-897d-5d9c96f4e129","resolution":{"observed_at":"2026-07-01T07:15:29.669716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.25234","last_updated":"2026-06-23T23:28:30Z","snapshot_observed_at":"2026-08-03T17:46:28.309569Z","submitted_at":"2026-06-23T23:28:30Z","title":"Structuring Sparsity: Block-Sparse Featurizers Capture Visual Concept Manifolds","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-25T23:54:29.531368Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.25234"},"observation_digest":"sha256:dfcaeab8f9cfe682139a2ea0bdc9591cff9f81c4ce9d6cffec7659cb0f0c031d","observation_id":"abdc302e-9d48-4cd8-99e0-f773d1af635c","resolution":{"observed_at":"2026-07-04T17:09:58.969579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.26396","last_updated":"2026-06-24T21:26:43Z","snapshot_observed_at":"2026-08-02T16:34:16.438122Z","submitted_at":"2026-06-24T21:26:43Z","title":"At the Edge of Understanding: Sparse Autoencoders Trace The Limits of Transformer Generalization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-26T01:27:39.812228Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.26396"},"observation_digest":"sha256:f5b6c895ba16a2764c580246b5986789780fa67624fa0d585e0c3c9921ac2b9f","observation_id":"055b7f6e-8c13-43d7-a417-8df7f05eb430","resolution":{"observed_at":"2026-06-26T01:28:50.560096Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":"2405.14860","doi":"10.48550/arxiv.2405.14860","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bernhard Ganter, Gerd Stumme, and R Wille","venue":"arXiv (Cornell University)","work_id":"b197f38e-6bff-4be1-9800-83179eba8fef","year":2024},"citing_paper":{"arxiv_id":"2606.29522","last_updated":"2026-06-28T17:32:59Z","snapshot_observed_at":"2026-08-05T08:26:21.192419Z","submitted_at":"2026-06-28T17:32:59Z","title":"Do Models Read What They Write? Causal Registers in Scratchpad Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T07:26:25.145919Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2606.29522"},"observation_digest":"sha256:28d351aeb278aea82e8a48363e016745622dbe6d530116ff6a750b4ef482efaf","observation_id":"b9b88ed0-c644-481f-9383-ead7b3cdb1a3","resolution":{"observed_at":"2026-06-30T07:34:21.854001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-07-13T05:35:58.568346Z","title":"arXiv preprint arXiv:2405.14860 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08946","last_updated":"2026-07-09T21:15:40Z","snapshot_observed_at":"2026-08-07T14:21:37.931530Z","submitted_at":"2026-07-09T21:15:40Z","title":"Training, Reading, and Editing Legible Transformers","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-13T05:35:58.568346Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2607.08946"},"observation_digest":"sha256:282c3d91ca15ad3d357cdf1c5f3fa9c020a23bb5f1da53db4b6a6787079be977","observation_id":"6fa62143-c4a6-4e01-b16f-2f525b11630a","resolution":{"observed_at":"2026-07-13T05:35:58.568346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-08-01T10:03:54.939594Z","title":"Michaud, Isaac Liao, Wes Gurnee, and Max Tegmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20596","last_updated":"2026-07-22T17:33:16Z","snapshot_observed_at":"2026-08-04T06:09:05.828651Z","submitted_at":"2026-07-22T17:33:16Z","title":"Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T10:03:54.939594Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2607.20596"},"observation_digest":"sha256:110558f9817444ed8b1799af7fa5e2a15fce12fe1299f75bfee8ff8743f64fda","observation_id":"b8f70879-0299-4241-8ecb-01922e686687","resolution":{"observed_at":"2026-08-01T10:03:54.939594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14860","snapshot_observed_at":"2026-07-31T15:17:59.776360Z","title":"and Michaud, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24425","last_updated":"2026-07-27T13:36:18Z","snapshot_observed_at":"2026-08-08T09:35:14.600946Z","submitted_at":"2026-07-27T13:36:18Z","title":"Context Is King: How In-Context Specification Shapes the Geometry of Concepts","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T15:17:59.776360Z"},"links":{"cited_paper":"/paper/2405.14860","citing_paper":"/paper/2607.24425"},"observation_digest":"sha256:d609d038da015bdc75e2a56a619bffd27767193dab7734ff81f44510660b6d92","observation_id":"c5e874e5-8fb3-4fe0-9415-af59f4f32906","resolution":{"observed_at":"2026-07-31T15:17:59.776360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.14860/citation-record","integrity":"/paper/2405.14860/integrity","json":"/paper/2405.14860/citation-record.json","paper":"/paper/2405.14860"},"outbound":[],"paper":{"arxiv_id":"2405.14860","last_updated":"2025-02-27T03:03:59Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:59:04Z","title":"Not All Language Model Features Are One-Dimensionally Linear"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 37 inbound Pith citation observations for arXiv:2405.14860."}