{"as_of":"2026-08-18T02:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f329b4338ea9850d2b16b244713ac2bd4dba8baab0656510c5a3d0e920b1843c","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:17:52.535540Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T14:41:21.582578Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:48:32.559321Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"cited_work":{"arxiv_id":"2506.17052","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17052","snapshot_observed_at":"2026-07-03T14:48:32.559321Z","title":"arXiv preprint arXiv:2506.17052 (2025)","venue":null,"work_id":"d1ea9468-358f-43fd-ab1d-be656be21216","year":2025},"citing_paper":{"arxiv_id":"2607.02494","last_updated":"2026-07-02T17:55:24Z","snapshot_observed_at":"2026-08-03T14:52:50.505098Z","submitted_at":"2026-07-02T17:55:24Z","title":"Towards Robustness against Typographic Attack with Training-free Concept Localization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-03T14:41:21.582578Z"},"links":{"cited_paper":"/paper/2506.17052","citing_paper":"/paper/2607.02494"},"observation_digest":"sha256:23751969a19b88fcb05f5b78c557bd3a30fd856fbf6024562e3ee0e71b17fc0e","observation_id":"a16380cb-f3e9-4345-9f56-68ffd849ae43","resolution":{"observed_at":"2026-07-03T14:48:32.560834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17052/citation-record","integrity":"/paper/2506.17052/integrity","json":"/paper/2506.17052/citation-record.json","paper":"/paper/2506.17052"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:52.146049Z","title":"Interpretable machine learning–a brief history, state-of-the-art and challenges","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.146049Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:410100db4d0615498d127cda7d311f6da4eb012b4fbdd343f944fe202631c31c","observation_id":"64ab2eca-44f6-48a9-99fd-20e5b87d9c7c","resolution":{"observed_at":"2026-08-15T19:17:52.146049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.787962Z","title":"Explainable ai: A review of machine learning interpretability methods","venue":null,"work_id":"2fbf6b19-50e2-43f6-aa30-c42fd4b4af6c","year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.151506Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:ccc8f035bc7d88e09d0ca10cb046e365c28853461f98ab72f79fa9ed1228bc7f","observation_id":"b643256d-d1e9-4627-926b-87ffc578a1fd","resolution":{"observed_at":"2026-08-15T19:17:53.793204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-08-17T14:45:30.096775Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-15T19:17:52.157002Z","title":"Deep inside convolutional networks: Visualising image classification models and saliency maps","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.157002Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:54c27ea2cbe6cc0dbfcb3607bb1fb9222fabb73b147ae9e0deebe488a9ca1ddb","observation_id":"ff3d312b-6801-4a5e-bd20-8d9fd9fc6294","resolution":{"observed_at":"2026-08-15T19:17:52.157002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.06579","last_updated":"2015-06-22T12:57:15Z","snapshot_observed_at":"2026-08-16T04:36:06.256807Z","submitted_at":"2015-06-22T12:57:15Z","title":"Understanding Neural Networks Through Deep Visualization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.06579","snapshot_observed_at":"2026-08-15T19:17:52.162267Z","title":"Understanding neural networks through deep visualization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.162267Z"},"links":{"cited_paper":"/paper/1506.06579","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a4dec488c6874dd3a786fbb90114caae5a536a9ef1f469fc9df3b0e06844f36a","observation_id":"5e2b43f0-461b-4252-a661-6d930a520d88","resolution":{"observed_at":"2026-08-15T19:17:52.162267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.772110Z","title":"Visualizing deep neural network decisions: Prediction difference analysis","venue":null,"work_id":"71096a33-baf1-43a0-9183-566559f34099","year":2017},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.167368Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a291efa9005bfaf4945100ae128fde9e853bd7609ac5f0bac0faf3e88bd35db1","observation_id":"642212fa-24cd-4ad3-b00d-3bff67f46833","resolution":{"observed_at":"2026-08-15T19:17:53.776931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:52.172216Z","title":"Grad-cam: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.172216Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:e292e5b7f62f386fb71927590e450e81fb89ec06e1c2018d38c5abd8ce3ddf34","observation_id":"4b9ac762-14d7-4e77-8bac-2a686f14ad36","resolution":{"observed_at":"2026-08-15T19:17:52.172216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.746538Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"b60bd51b-2935-43f6-ad55-7cc5b4a363ae","year":2017},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.176722Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:df04f9a1d5d0cda51128075ca22568552bd4a42daf5da5a575136eae1eed2413","observation_id":"20b3044b-6645-4246-9b13-bdd5ea2172f9","resolution":{"observed_at":"2026-08-15T19:17:53.751452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.730977Z","title":"Attention is all you need","venue":null,"work_id":"f9a2d95b-e7f4-4639-ac99-b5fd3627ccbb","year":2017},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.181985Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:87ced57ae9e3eab539c96b6149f3863b58ee3aafee06de524ee5a93a896fc329","observation_id":"237e3feb-ef2f-46de-8d7d-2f62a0885404","resolution":{"observed_at":"2026-08-15T19:17:53.736195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01761","last_updated":"2024-01-30T17:38:54Z","snapshot_observed_at":"2026-08-16T14:23:09.488256Z","submitted_at":"2024-01-30T17:38:54Z","title":"Rethinking Interpretability in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01761","snapshot_observed_at":"2026-08-15T19:17:52.186664Z","title":"Rethink- ing interpretability in the era of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.186664Z"},"links":{"cited_paper":"/paper/2402.01761","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:d5818ab992a96aef8b1ec63bf1489cd7a9e26a35b2794bb9fac06a367dd591ea","observation_id":"9761cfd0-fe32-434d-a5ea-4fd9d92ba08f","resolution":{"observed_at":"2026-08-15T19:17:52.186664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.715745Z","title":"Transformer feed-forward layers are key-value memories","venue":null,"work_id":"db30264e-0697-4bb8-8635-7ae57ceeea75","year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.192104Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:9df9747184e60061126b5d8bc49e84c5bbdd0a78aac02280b13fedd82759c4fa","observation_id":"e7b4bd07-1b98-45f0-ab26-e81f09eee511","resolution":{"observed_at":"2026-08-15T19:17:53.720636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.698663Z","title":"Transformer feed-forward layers build predictions by promoting concepts in the vocabulary space","venue":null,"work_id":"8063566d-7032-4eeb-811d-d3d001501337","year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.197226Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:6d654499a0227e8e16f5bcd218eca510cf9e6201a1d6ea9146382ae3dc990c8a","observation_id":"0c796c4d-e5e5-4d7e-a76c-5e6daa386b1a","resolution":{"observed_at":"2026-08-15T19:17:53.703794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.682716Z","title":"The emergence of number and syntax units in lstm language models","venue":null,"work_id":"be868bcb-9a55-4361-9d51-791621ef7ea6","year":2019},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.201793Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:9b05e1ee0932787d6215fc2d0b9224116aa195f9e43d00521e8ffa0db7390049","observation_id":"5a469460-6d1a-4e4e-b51d-f9904a857e38","resolution":{"observed_at":"2026-08-15T19:17:53.687969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.666457Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"f06765b2-8d94-433f-9d7f-d044c1e82a13","year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.207264Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:f5635a7a0457ffb3970280cf95ce182af42b69a9fb677c41eeb7749d896beda7","observation_id":"221d03ec-4c1d-4460-8928-c38e345c0c20","resolution":{"observed_at":"2026-08-15T19:17:53.671558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07229","last_updated":"2023-08-01T18:41:52Z","snapshot_observed_at":"2026-08-13T02:17:30.405636Z","submitted_at":"2022-10-13T17:55:53Z","title":"Mass-Editing Memory in a Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07229","snapshot_observed_at":"2026-08-15T19:17:52.211980Z","title":"Mass- editing memory in a transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.211980Z"},"links":{"cited_paper":"/paper/2210.07229","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:76461ea9bb5c039684ed4c6f25ab497b56dcdb043139144c0cddc2a5a38f7d2d","observation_id":"1d3f0020-5787-4ebc-a371-fd24cf007610","resolution":{"observed_at":"2026-08-15T19:17:52.211980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.650797Z","title":"Lima: Less is more for alignment","venue":null,"work_id":"703f5c1c-94f7-48c9-889b-64bfe1d4721f","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.217076Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:1831f750d61397ff242c4abc32471e9f755aa9d98ec4d27bbcaf57521435675c","observation_id":"3fe043fa-b81c-43bd-bba2-69f7f47568d6","resolution":{"observed_at":"2026-08-15T19:17:53.655741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.633552Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"569c7985-3d66-4a29-8d5f-33ea1ac50e69","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.222069Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:b12a2b1203c1fd2770f9a6edea79b6b7e8531c861dcc1d1db4dac061de2f9c7e","observation_id":"2691784c-8244-46e8-9204-be5d940657d0","resolution":{"observed_at":"2026-08-15T19:17:53.639436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T19:17:52.226502Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.226502Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:972dca0147a92addcfcdfb6b0fced2f7d21014801cbe0ab9c0dbdc24e10f60cf","observation_id":"819be478-7c94-44f6-b8e0-d3bf80a4262a","resolution":{"observed_at":"2026-08-15T19:17:52.226502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:52.232206Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.232206Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:8bdc086b8cbda804255d48d311bf4754161b1031114674d8d02cd64d087eb7cc","observation_id":"a8c62cfb-af2f-4037-8945-8fe333d55559","resolution":{"observed_at":"2026-08-15T19:17:52.232206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-15T19:17:52.241939Z","title":"Efficient estimation of word representations in vector space, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.241939Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:ba5ee7c065a884ecd2061a9eb37db807ac063797e8e2f74b11704daf0bd30f3d","observation_id":"f6cce585-25e4-44ca-ae2b-ff260f21d0e8","resolution":{"observed_at":"2026-08-15T19:17:52.241939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.592157Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":"9084d21e-0114-46df-82b7-4f64b254adda","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.246751Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:e0e109376fdff7cf5d9cab71cb3d5beccdb6214dc2b3dd3a1f638a19e668fa06","observation_id":"cd49423f-e7be-4217-8a54-32e790c4e333","resolution":{"observed_at":"2026-08-15T19:17:53.597064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-15T15:50:24.074149Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-15T19:17:52.251181Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.251181Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:26e3c6cf1cf945d1884e1455ef724021ef1caa8afa9974454e79177a0844144e","observation_id":"83b3e45c-ae52-4120-a566-991f529ade7a","resolution":{"observed_at":"2026-08-15T19:17:52.251181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15154","last_updated":"2023-10-23T17:55:31Z","snapshot_observed_at":"2026-08-08T01:44:57.952179Z","submitted_at":"2023-10-23T17:55:31Z","title":"Linear Representations of Sentiment in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15154","snapshot_observed_at":"2026-08-15T19:17:52.255950Z","title":"Linear representations of sentiment in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.255950Z"},"links":{"cited_paper":"/paper/2310.15154","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:25780c5b31599bb577277a96ced5f5e49c2ef729701977ad69bfc78254971388","observation_id":"c9626cbd-ac7f-4a70-b9e8-ea500237e2fb","resolution":{"observed_at":"2026-08-15T19:17:52.255950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-08-17T14:45:35.765424Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-15T19:17:52.260503Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.260503Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:dd6b44fb14cf7bc7f99fee3aacdee0fe926212352be075cb2d35988234601f31","observation_id":"5ac3ff6e-50cb-46cf-a1a5-3aba4bea503c","resolution":{"observed_at":"2026-08-15T19:17:52.260503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-15T08:04:06.283165Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-15T19:17:52.265177Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.265177Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a56f0bbea9b02b2edd08d77dc652a28b7c3a588520762fd4e40fe505bcda7179","observation_id":"3fbd40d7-8645-4ec1-95d8-3521f64a2617","resolution":{"observed_at":"2026-08-15T19:17:52.265177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03813","last_updated":"2023-12-06T18:27:07Z","snapshot_observed_at":"2026-08-16T14:37:04.314654Z","submitted_at":"2023-12-06T18:27:07Z","title":"Improving Activation Steering in Language Models with Mean-Centring","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03813","snapshot_observed_at":"2026-08-15T19:17:52.270009Z","title":"Improving activation steering in language models with mean-centring","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.270009Z"},"links":{"cited_paper":"/paper/2312.03813","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:3848d9ed6f1ff7bfb30de47e61bef3d75d89f6223ca3e58533ac518a1c73ea45","observation_id":"b2124474-298c-46db-94ea-6adb117f5cf8","resolution":{"observed_at":"2026-08-15T19:17:52.270009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-08-17T07:39:23.832733Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-08-15T19:17:52.275006Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.275006Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:bd2671f3da32e2a71fe109cf0f3163afa182edd260c127995433f3b58834f9b8","observation_id":"d569c0c0-f6bf-4ada-aa56-97d22086cf4e","resolution":{"observed_at":"2026-08-15T19:17:52.275006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.575210Z","title":"interpreting gpt: the logit lens","venue":null,"work_id":"6ad023b7-4ca6-4960-92f3-137a8e96c5a7","year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.279840Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:069f5757b6d9628e6b7fceb2b77f77159c926aa30e366eedd85990f1f14aa084","observation_id":"a58f1d1e-39a8-4eb5-bd90-16e91e99310b","resolution":{"observed_at":"2026-08-15T19:17:53.580827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.560348Z","title":"Investigating gender bias in language models using causal mediation analysis","venue":null,"work_id":"785e10bb-2cd5-45a1-910a-cc9415771af1","year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.284539Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:ca886adfcee3c1a29b3ae8bff97bf745d0c01063cdba8e620b21cc399846bb1e","observation_id":"6919faa0-7e13-41b7-8ac2-92568ab038c5","resolution":{"observed_at":"2026-08-15T19:17:53.565264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05969","last_updated":"2023-05-16T16:24:55Z","snapshot_observed_at":"2026-08-15T09:56:57.369509Z","submitted_at":"2023-04-12T16:46:43Z","title":"Localizing Model Behavior with Path Patching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05969","snapshot_observed_at":"2026-08-15T19:17:52.289390Z","title":"Localizing model behavior with path patching","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.289390Z"},"links":{"cited_paper":"/paper/2304.05969","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:47031b6891033a5d69363258ecbb37f2b380794886b263f0baca6314b47767c4","observation_id":"bcdc1773-2f24-431e-b9e6-994e4b714c29","resolution":{"observed_at":"2026-08-15T19:17:52.289390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.544786Z","title":"Inducing causal structure for interpretable neural networks","venue":null,"work_id":"a98cfde0-11ef-413d-a2b1-612f274f7659","year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.294284Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:19863636f1805e144f5aaf028a255e6516b798e04e434531170edbc95ff186af","observation_id":"3e7f17ba-d12a-4f79-8e33-91b390a63f50","resolution":{"observed_at":"2026-08-15T19:17:53.549853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.529823Z","title":"Transformerlens","venue":null,"work_id":"70e86e3c-ceeb-4dcb-b721-3fd2f76b4bca","year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.298852Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:3720ea73f458ad53853c7d911c0fa3b6e20303e18d0eeb051189f4e515284dd9","observation_id":"909a3951-0689-420c-8119-5d57319de618","resolution":{"observed_at":"2026-08-15T19:17:53.534510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.513824Z","title":"Vit prisma: A mechanistic interpretability library for vision transformers","venue":null,"work_id":"08e3afa3-31a9-4f3a-b037-8c80d6d18612","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.303537Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:b34acdc9de50543357efaee46ff45498ce214a896f8f84e30c55099f2bbb6d5b","observation_id":"db1964c7-2d63-417f-85b7-abbfe89e212b","resolution":{"observed_at":"2026-08-15T19:17:53.519580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18815","last_updated":"2024-11-10T12:49:15Z","snapshot_observed_at":"2026-08-16T14:14:19.170830Z","submitted_at":"2024-02-29T02:55:26Z","title":"How do Large Language Models Handle Multilingualism?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18815","snapshot_observed_at":"2026-08-15T19:17:52.308331Z","title":"How do large language models handle multilingualism? arXiv preprint arXiv:2402.18815, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.308331Z"},"links":{"cited_paper":"/paper/2402.18815","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:863db4be3a7450ac0ffc7788ceea382cbaa30f2c4b27af3e98bec8d1594eb747","observation_id":"d3fe72d7-9fc3-49cc-a5bd-fa86c1c47c03","resolution":{"observed_at":"2026-08-15T19:17:52.308331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10588","last_updated":"2024-06-08T11:15:14Z","snapshot_observed_at":"2026-08-17T04:04:31.196189Z","submitted_at":"2024-02-16T11:21:28Z","title":"Do Llamas Work in English? On the Latent Language of Multilingual Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10588","snapshot_observed_at":"2026-08-15T19:17:52.313609Z","title":"Do llamas work in english? on the latent language of multilingual transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.313609Z"},"links":{"cited_paper":"/paper/2402.10588","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:6cfb45229f3a4ffa4a9c0f7d90f619accf186eeec4b97ab05a625bebaf546924","observation_id":"99bd0b90-0298-4efb-97cc-60a315ee15be","resolution":{"observed_at":"2026-08-15T19:17:52.313609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-16T13:05:36.754275Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-15T19:17:52.319117Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.319117Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a6c8cb4992e56380c129fc9068d77bc9d1ea35a0026e3b9f7d13eabf8fcb4da7","observation_id":"fcb8239f-9043-4c1c-b6d0-7581405ae700","resolution":{"observed_at":"2026-08-15T19:17:52.319117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-15T19:17:52.324277Z","title":"Scaling and evaluating sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.324277Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:c9b468a462e3f04883481167b20ac0fb7c223fdbea5b0de579822e76e6114b0d","observation_id":"0d257a39-dcee-4505-9392-c535afc26dcf","resolution":{"observed_at":"2026-08-15T19:17:52.324277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-15T19:17:52.329084Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.329084Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:78ee8c676cb252b1e845d935073a59a5cb835510dca092f12868f4a022bdb402","observation_id":"4d5e9480-8f7b-4658-933d-fb99fa067da3","resolution":{"observed_at":"2026-08-15T19:17:52.329084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.497754Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":"d7a02c60-d270-460d-870c-cd027959e68c","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.334550Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:baaa7a985bc074d79f2ea7c06a2e7a08f041dec4d9fadebd595d51e510281588","observation_id":"bb2f4150-01fe-4982-b398-40de9ffdb133","resolution":{"observed_at":"2026-08-15T19:17:53.503642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.482504Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"bd4a70ae-9583-4e32-8511-e6f4513dc60a","year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.339187Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a0078378ff5c27683a87a05ac6cb0e579cc2a6185fd64481131181bf5f7020a2","observation_id":"b299e770-df4c-4212-aed7-614042f39d1b","resolution":{"observed_at":"2026-08-15T19:17:53.487516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.466555Z","title":"A comprehensive survey on test-time adaptation under distribution shifts","venue":null,"work_id":"5af38f8d-e9a9-4b1e-af7c-7c437b536263","year":2025},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.343666Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:c88384a351c4f31027c208c885858141c93244bd62b3c565766e479394c15beb","observation_id":"73ebeb61-65e3-4b43-a40b-2d146a86ddb3","resolution":{"observed_at":"2026-08-15T19:17:53.471484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.450222Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"e6dc6e73-d522-4c0c-bbe2-8c303c209655","year":2019},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.347995Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:2dd556eddc4969ffac4bf634be7d5fbf072c36988a07aec3ca1e617be82ce68a","observation_id":"3f473369-48c2-4778-8403-99a9eac5c26f","resolution":{"observed_at":"2026-08-15T19:17:53.455413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-15T19:17:52.353257Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.353257Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:29987754a173c237479a7710b246019c104104db10b84b7517c35cf47e2067a7","observation_id":"687ac887-d8c1-4734-9783-fabfd09df58a","resolution":{"observed_at":"2026-08-15T19:17:52.353257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T19:17:52.357976Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.357976Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:383059607b498308e8fc30e85ac22ea55adab25eefb3f12548902501ecd08b1d","observation_id":"17e0b8fc-f7a5-488e-9a38-a31038f39cdc","resolution":{"observed_at":"2026-08-15T19:17:52.357976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.434624Z","title":"Is your code generated by chatGPT really correct? rigorous evaluation of large language models for code generation","venue":null,"work_id":"ba033e30-5148-4cce-8ea4-783c3e89539d","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.362703Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:453a2b41c9e04eb3698d81c3f78081b4067072481297f95d8cba66ad5b5c5eb5","observation_id":"d7a1ab93-b49f-47ca-ba9d-fa00e0a9023e","resolution":{"observed_at":"2026-08-15T19:17:53.439661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.418792Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"04ac5b9e-1b1a-4586-9e00-150deeb5baa7","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.367103Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:ca6566a309d540089e04ef2f6b3ea2c8f07ab6abe02bd3e59efc12c8c6c7254a","observation_id":"8075964b-0708-4cb9-b11e-d80c6d4c5c93","resolution":{"observed_at":"2026-08-15T19:17:53.423667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.404551Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":"45469c28-2f54-4ecb-ac32-101dfe94aa6e","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.372337Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:832cc19b6a382a082f7bbbb19b1fe645f57f0830ddc2a0009b2e8fc872dc7f75","observation_id":"4b7d8c2e-f06d-4c25-bc2d-ddc1ad5348cf","resolution":{"observed_at":"2026-08-15T19:17:53.409202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.390280Z","title":"Interpretability dreams","venue":null,"work_id":"e6ffc2ff-114d-4613-a467-be3935cad8af","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.376800Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:d8dabc2432785f14571a6b6c2dce3f16abc0ec74d00d78426fd605ba78c24eb0","observation_id":"32333543-dfa8-417c-8d82-0f8846f9c097","resolution":{"observed_at":"2026-08-15T19:17:53.394726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T19:17:52.381437Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.381437Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:f7ca8ed621f5c28522dcbc45abb8f6e05d40a0b00e20bde4524b2691f360c0ce","observation_id":"9064121e-3617-45a1-adf7-3cd50690821e","resolution":{"observed_at":"2026-08-15T19:17:52.381437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T19:17:52.385930Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.385930Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:d6375be2ae6274bada365f9764592a2163ad9faac782cd9d61b24578a918aa38","observation_id":"ce5b0fc8-b6da-4bbe-b3ed-d1147dba9c51","resolution":{"observed_at":"2026-08-15T19:17:52.385930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T19:17:52.390705Z","title":"Universal and transferable adversarial attacks on aligned language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.390705Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:15c7004209b472d365a5243bddb82fa2b14cda2265009cdab5b98ea474de445d","observation_id":"f2c96340-ff62-45bd-8b02-11fe58fe6bf3","resolution":{"observed_at":"2026-08-15T19:17:52.390705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T19:17:52.395395Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.395395Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:e5d4b789c4e23c4ea2e497dd01f38eb9d0235cd7f7c615d45386d54f9e092bcf","observation_id":"8a798688-a531-43f5-8999-672f930d95ff","resolution":{"observed_at":"2026-08-15T19:17:52.395395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.375659Z","title":"Vision transformers need registers","venue":null,"work_id":"75c4d6b9-df5d-4de1-b490-bfca64b79f50","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.400310Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:1e67465a609cda4ccf38b9d5efdec307f1d7b12a710feaad37ef3ee784b0027d","observation_id":"5f00f00d-7a0a-4be8-81eb-a06372aa70ed","resolution":{"observed_at":"2026-08-15T19:17:53.380338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.361177Z","title":"Visualizing and understanding convolutional networks","venue":null,"work_id":"77abec66-bb4b-4da1-842f-b51a0feaee17","year":2014},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.404758Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:79f6ff93d82764d89df19b67251aa67a441e65db1732770803651b03b82c242e","observation_id":"cefe7a3d-2aab-41ed-bbbe-6e8af1ef90a2","resolution":{"observed_at":"2026-08-15T19:17:53.365989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.346679Z","title":"Network dissec- tion: Quantifying interpretability of deep visual representations","venue":null,"work_id":"fc99b8cb-85d6-4b02-9be0-14036a53a5f9","year":2017},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.410307Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:aa42125f4150e2d0e63926e68a4bef8376416ea56110b69319e2930c16a6bf85","observation_id":"2137c90c-b7f3-4931-998d-6da6021f36ea","resolution":{"observed_at":"2026-08-15T19:17:53.351476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.330890Z","title":"Interpreting deep visual representa- tions via network dissection","venue":null,"work_id":"7a02d711-ce87-4e64-af09-ce29ab494253","year":2018},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.415250Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:6225381b1839ed825f031e3a31947ca34155b764e7809cb5caf6fc1a793410c7","observation_id":"d88e2d76-bb37-4b71-a6f0-b9b7248221be","resolution":{"observed_at":"2026-08-15T19:17:53.335811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.315287Z","title":"Interpretable basis decomposition for visual explanation","venue":null,"work_id":"4b8ece01-b843-4f65-a8ed-3331ef8ffa1a","year":2018},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.419947Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:23104e5686179b8afd539ee03e644e3e19505dba0375c27ead267c4241191c3b","observation_id":"aa756b2a-7760-441c-a14a-5d5c9283c4ee","resolution":{"observed_at":"2026-08-15T19:17:53.320829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.299688Z","title":"Understanding the role of individual units in a deep neural network.Proceedings of the National Academy of Sciences, 117(48):30071–30078, 2020","venue":null,"work_id":"f99c8bad-3623-4ace-a909-3aeb32546103","year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.424227Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:703f3155634b0892bd0dec9e30bfbed0fbde255cdc01d80527b46eaf4619ad27","observation_id":"4fa9617f-09e8-45bb-aa96-e094ef2ced7e","resolution":{"observed_at":"2026-08-15T19:17:53.305156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.284961Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":"0b3444fc-fa06-4f4e-949a-226271b0fb63","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.429396Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:4f3e797cc89037664256f7a10d6a7a2d9574554066bbb1542dcd246f26390328","observation_id":"e2db74ee-c989-4540-b24d-8c16022b83bf","resolution":{"observed_at":"2026-08-15T19:17:53.290059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.268992Z","title":"Does localization inform editing? surprising differences in causality-based localization vs","venue":null,"work_id":"02cac0b5-100d-4947-974b-e9d6030f74d4","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.433605Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:474c381c66db1e859b132965f97fa32c08ebd05a02bdc55d500e15f94895de51","observation_id":"a0d43275-b1e8-40e1-b4b5-f1e6e0a668fe","resolution":{"observed_at":"2026-08-15T19:17:53.274066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.253514Z","title":"Editing common sense in transformers","venue":null,"work_id":"aa5a61a4-deac-45d0-a3a1-0c3d9138bafc","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.439095Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:0df3c0bfe853e74900f677c895284feff555e62f5cd5680658b5f2caf6ba5608","observation_id":"a2e6a373-50b8-476c-8736-978ca4eba91b","resolution":{"observed_at":"2026-08-15T19:17:53.258520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.237841Z","title":"Massive editing for large language models via meta learning","venue":null,"work_id":"83377826-43b6-4f63-a715-4e10e88a77c5","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.443511Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:48224053fc8f1c0751bf0a50734490956f5e85a8b96cf232ff2fa43731c741d8","observation_id":"3e7da4eb-9637-4224-b636-9d2aac054a2d","resolution":{"observed_at":"2026-08-15T19:17:53.242990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.222947Z","title":"Pmet: Precise model editing in a transformer","venue":null,"work_id":"d2def131-7197-4d46-a6e9-bc111b544014","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.448164Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:2ed2c8278560a33f8c2c2c907d0fae9bf35d2fe276df344f2b91ec099bea5c97","observation_id":"b549e9ad-8aed-47db-874e-adf4fadb6513","resolution":{"observed_at":"2026-08-15T19:17:53.227618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.207650Z","title":"Journey to the center of the knowledge neurons: Discoveries of language-independent knowledge neurons and degenerate knowledge neurons","venue":null,"work_id":"2cec38ac-41a0-45c1-b697-4a5b75cfb1f4","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.452904Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:1b2d9afee32a3d27cac9a091da863afece27f13862331b1e9d2cf0af8a4b9f92","observation_id":"f29ad2ba-d8dd-4f5e-ad0b-33c035e61128","resolution":{"observed_at":"2026-08-15T19:17:53.213111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02066","last_updated":"2021-03-06T17:35:13Z","snapshot_observed_at":"2026-08-17T07:40:11.589035Z","submitted_at":"2020-10-05T15:04:11Z","title":"Are Neural Nets Modular? Inspecting Functional Modularity Through Differentiable Weight Masks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02066","snapshot_observed_at":"2026-08-15T19:17:52.457340Z","title":"Are neural nets modu- lar? inspecting functional modularity through differentiable weight masks","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.457340Z"},"links":{"cited_paper":"/paper/2010.02066","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:e0254b4bdbe807017bddcdb087440e17994ff4eeaebf9ce178e6fa757a08efc8","observation_id":"d1b6891a-83c8-4bc3-b3b1-41f22a11dcb6","resolution":{"observed_at":"2026-08-15T19:17:52.457340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06837","last_updated":"2021-12-13T17:49:16Z","snapshot_observed_at":"2026-08-17T03:30:18.176752Z","submitted_at":"2021-12-13T17:49:16Z","title":"Sparse Interventions in Language Models with Differentiable Masking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.06837","snapshot_observed_at":"2026-08-15T19:17:52.462472Z","title":"Sparse interventions in language models with differentiable masking","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.462472Z"},"links":{"cited_paper":"/paper/2112.06837","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:de91508bc466cb4bd7f4b3d3e9c9278bdf3853031f7706b842bef3458da19f02","observation_id":"e16d825b-4161-4458-b8d0-0e7b859f6f3b","resolution":{"observed_at":"2026-08-15T19:17:52.462472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08696","last_updated":"2022-03-10T02:28:59Z","snapshot_observed_at":"2026-08-16T18:30:49.967455Z","submitted_at":"2021-04-18T03:38:26Z","title":"Knowledge Neurons in Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08696","snapshot_observed_at":"2026-08-15T19:17:52.467637Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.467637Z"},"links":{"cited_paper":"/paper/2104.08696","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:2dbf72a3a0637b3eb2b7f81bead88e7aaca2c4d301129045aed61a0d6a382870","observation_id":"28b192fa-5f25-4c66-a537-0bd45eb0313a","resolution":{"observed_at":"2026-08-15T19:17:52.467637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.191465Z","title":"Finding and editing multi- modal neurons in pre-trained transformers","venue":null,"work_id":"8771d5c3-2b9a-4e36-841b-70faff699652","year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.472343Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:9297e94a04e56c643efa2a83aa5d84a8f8a45a061d79f60094d18c3000db4dac","observation_id":"bc6a5fd1-ef38-48c3-a8c3-a80f97a42aef","resolution":{"observed_at":"2026-08-15T19:17:53.197087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.175816Z","title":"Towards neuron attributions in multi-modal large language models","venue":null,"work_id":"dc72851a-ac08-4348-a97c-46a184e8055e","year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.477348Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:d0dad5974562cad73fd9edcb0988ca0fc60d963b9f8408222095e0deab89761a","observation_id":"f6a365e1-e286-470a-9e25-1a23d00a9f89","resolution":{"observed_at":"2026-08-15T19:17:53.180824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15574","last_updated":"2024-04-24T00:24:03Z","snapshot_observed_at":"2026-08-16T13:58:20.510591Z","submitted_at":"2024-04-24T00:24:03Z","title":"Retrieval Head Mechanistically Explains Long-Context Factuality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15574","snapshot_observed_at":"2026-08-15T19:17:52.481918Z","title":"Retrieval head mecha- nistically explains long-context factuality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.481918Z"},"links":{"cited_paper":"/paper/2404.15574","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:9d74a3cc1aca18b446ef8b07cbd0d06a4499abf2bc6f153520c689255363a3b5","observation_id":"94bf6f2b-6176-4f0c-922b-f484219d0d79","resolution":{"observed_at":"2026-08-15T19:17:52.481918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09230","last_updated":"2023-12-14T18:55:47Z","snapshot_observed_at":"2026-08-16T14:34:39.123827Z","submitted_at":"2023-12-14T18:55:47Z","title":"Successor Heads: Recurring, Interpretable Attention Heads In The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09230","snapshot_observed_at":"2026-08-15T19:17:52.486631Z","title":"Successor heads: Recurring, interpretable attention heads in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.486631Z"},"links":{"cited_paper":"/paper/2312.09230","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:6391b2e7b5b8330169cb75e001741dc25970dcb4b774414f1a62ebda84b8a41b","observation_id":"9aed7111-a7da-4ae8-ba57-ed04aa60d13c","resolution":{"observed_at":"2026-08-15T19:17:52.486631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-15T19:17:52.491909Z","title":"Sparse autoen- coders find highly interpretable features in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.491909Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:d3bd3b527723066c40676f1e768556cac57c4743137ab690ab6e3730bc91f56d","observation_id":"b586e7ea-7c1e-4318-93cc-4662c38e4816","resolution":{"observed_at":"2026-08-15T19:17:52.491909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:52.497381Z","title":"Zoom in: An introduction to circuits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.497381Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:cfdb26260dc3e3889bfd2cb5cfbacc0e97768c2ed6361c8073c62fecfb97d7d2","observation_id":"7300ee97-b5f2-4e4a-8dd3-616d91825639","resolution":{"observed_at":"2026-08-15T19:17:52.497381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-15T19:17:52.501945Z","title":"Mechanistic interpretability for ai safety–a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.501945Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:9ec975531ee533d625ba0e8730793df6e4a1b4b5db001e41666125c154a2b9ce","observation_id":"6d80426b-0b0d-41e9-8963-a3827e1d2793","resolution":{"observed_at":"2026-08-15T19:17:52.501945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-15T19:17:52.506840Z","title":"Open problems in mechanistic interpretability","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.506840Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a2fa16f867a73e3633320eed405a2d92a43db8c34cfc83fcac154a233a10c94c","observation_id":"b99e52d2-27e3-4523-b6f1-919dd739f733","resolution":{"observed_at":"2026-08-15T19:17:52.506840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.160017Z","title":"In-context learning and induction heads","venue":null,"work_id":"64d200f2-0c55-44a0-9e05-718d8280f40a","year":2022},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.511266Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:a9505f52452e7a9155f1f7beabc9969c1d4b2695a8adddd73edb5fb79f7e1d84","observation_id":"6be5256e-4ce6-475a-88c2-b11c428be253","resolution":{"observed_at":"2026-08-15T19:17:53.164812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.143977Z","title":"Interpretability in the wild: a circuit for indirect object identification in GPT-2 small","venue":null,"work_id":"5a5eab94-ea01-4015-99a7-6bed4eba552f","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.516402Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:52808a0b407bcfec3c30287052864ff4ca96cc056ad05c65589ac1f513626522","observation_id":"8c13d93a-1e39-41d0-a3ea-ae34912b38ab","resolution":{"observed_at":"2026-08-15T19:17:53.149290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.124765Z","title":"Progress measures for grokking via mechanistic interpretability","venue":null,"work_id":"4c88b6ea-004e-492a-8dd1-eb60f1566ec1","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.521099Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:c7a053a24bc5d59ca40cd0c4a6987ce57f857a04ee78fe6389162047dc9eaf90","observation_id":"e5519bd1-d3fd-4315-a5cb-0501924c2b6d","resolution":{"observed_at":"2026-08-15T19:17:53.132461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02128","last_updated":"2024-10-28T11:14:54Z","snapshot_observed_at":"2026-08-16T13:46:22.749016Z","submitted_at":"2024-06-04T09:11:46Z","title":"Iteration Head: A Mechanistic Study of Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02128","snapshot_observed_at":"2026-08-15T19:17:52.525737Z","title":"Iteration head: A mechanistic study of chain-of-thought","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.525737Z"},"links":{"cited_paper":"/paper/2406.02128","citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:da1ee03d32079320bf5e40952801edce029ecc3777d6daaa40be1b0baa75ef4e","observation_id":"ca93db5b-6680-463e-9a74-f5884919918a","resolution":{"observed_at":"2026-08-15T19:17:52.525737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.107810Z","title":"the Golden Gate Bridge","venue":null,"work_id":"18cb9101-a202-44d1-8099-00f469111e2c","year":2023},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.530458Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:0f03d151cd78b497a38f6a8d1fc33d5cfa8c2ef855c49be8de4c5bd142925c30","observation_id":"d5636ce6-db96-401c-8c66-602474f4cdd5","resolution":{"observed_at":"2026-08-15T19:17:53.112770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.089572Z","title":"Tabby cat","venue":null,"work_id":"8411c28a-91df-490d-b65e-860eeb190ba6","year":null},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.535540Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:7a37a90c43c7ab3b60878ab1a0cc9cf10b5b3503c569a59877c0c8476b7b95c3","observation_id":"702bfc56-2627-4152-8ce0-b9ec394778f0","resolution":{"observed_at":"2026-08-15T19:17:53.096049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:17:53.607467Z","title":null,"venue":null,"work_id":"19ce0be9-8cb3-4b6c-8cae-e8daef1d0bd7","year":2021},"citing_paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T19:17:52.237132Z"},"links":{"citing_paper":"/paper/2506.17052"},"observation_digest":"sha256:8080a7c9ddb7584dc4164bb9c63cbe36ae91cb49ed52539ff9b03dac4b9c5c5c","observation_id":"8c24b08e-4f0d-4a80-89b8-f589c85e364d","resolution":{"observed_at":"2026-08-15T19:17:53.612735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17052","last_updated":"2025-06-20T15:04:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T02:43:17.294961Z","submitted_at":"2025-06-20T15:04:11Z","title":"From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":0,"verified_fuzzy":43},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 1 inbound Pith citation observation for arXiv:2506.17052."}