{"as_of":"2026-08-11T10:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a5093ada2e19ba8227a9a53cf16aae5eed0d94e63ec8c11843b6c4c451f7998","coverage":[{"denominator":193,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:36:58.802066Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07594/citation-record","integrity":"/paper/2608.07594/integrity","json":"/paper/2608.07594/citation-record.json","paper":"/paper/2608.07594"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.408229Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.408229Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:74da832be0a1ac8bc93cb033f54e90214d795ff3c5e87e1db7e8a6c3d7c7312f","observation_id":"899a6c02-aea0-4c89-abd3-6cb70d86a9b1","resolution":{"observed_at":"2026-08-11T00:36:58.408229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.413252Z","title":"Second Conference on Language Modeling , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.413252Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:bc6b04d3e7afcf5def2ec0991b0f75cf6e865a951c46ab9d077af0c29edfb020","observation_id":"52877553-34d2-4ca8-bf41-a058a7253f7b","resolution":{"observed_at":"2026-08-11T00:36:58.413252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.417476Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.417476Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:99097fe75b0470830b213ba9f3cb6cb5755e426a3836b0dc13dffdd48c03c2e9","observation_id":"085065e1-099c-4e17-8457-ded134ea55f8","resolution":{"observed_at":"2026-08-11T00:36:58.417476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.02164","last_updated":"2020-03-03T05:33:49Z","snapshot_observed_at":"2026-08-09T12:15:11.395844Z","submitted_at":"2019-12-04T18:32:15Z","title":"Plug and Play Language Models: A Simple Approach to Controlled Text Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.02164","snapshot_observed_at":"2026-08-11T00:36:58.422205Z","title":"arXiv preprint arXiv:1912.02164 , year=","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.422205Z"},"links":{"cited_paper":"/paper/1912.02164","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a049e45965172611b504ff41737cfcd92261974305d3f11f04b09f1454a08930","observation_id":"5ea2baa5-71d3-486a-99d1-f55881eaa259","resolution":{"observed_at":"2026-08-11T00:36:58.422205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.427272Z","title":"Findings of the Association for Computational Linguistics: ACL 2022 , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.427272Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7744c3e1a645ad0cd12afae77e752feb51b031973c7a1b6a84f3836628bf9f95","observation_id":"6b5f2e08-efe2-4754-a9b0-b66917c11fbe","resolution":{"observed_at":"2026-08-11T00:36:58.427272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.431357Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.431357Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:fa272fb0dbfecf1c8bbb6fdf3a876412aa6cdf2bea68dc78311f2a1d30df4335","observation_id":"3e59a8e6-c1a6-4fef-a503-afb46f29decb","resolution":{"observed_at":"2026-08-11T00:36:58.431357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-11T00:36:58.435669Z","title":"arXiv preprint arXiv:1803.05457 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.435669Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7cdb71988aa5c985d0a380d9eb85e1f27a6cf31ff805612c17ec2ff1f6ae721a","observation_id":"db515cd9-c51c-40c5-86a0-e3928f769054","resolution":{"observed_at":"2026-08-11T00:36:58.435669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.440553Z","title":"Proceedings of the AAAI conference on artificial intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.440553Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:fdeef3deccbef7fe12e95a1a410ee4dfb7d9715ae9260107e5c9e57fee23fa36","observation_id":"d10e44d3-54fc-44f3-b888-2d4f4fb20e48","resolution":{"observed_at":"2026-08-11T00:36:58.440553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.444868Z","title":"Communications of the ACM , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.444868Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:8ec8c7700441a28c6a96ded7666ab1f1a77c31db9672cbe23a4c35e247e621ce","observation_id":"2a4e0fcd-015e-4ec3-b572-ec2a278b8eb4","resolution":{"observed_at":"2026-08-11T00:36:58.444868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T00:36:58.448874Z","title":"arXiv preprint arXiv:2203.15556 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.448874Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3ce52ea41776a63c01c7a23a7b5d6e0aaa5829a10b2eb847cd69441d772d0a63","observation_id":"0b549f49-adc4-4097-bc72-cd580e1db3db","resolution":{"observed_at":"2026-08-11T00:36:58.448874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01505","last_updated":"2024-12-02T13:58:35Z","snapshot_observed_at":"2026-08-09T03:34:22.901333Z","submitted_at":"2024-12-02T13:58:35Z","title":"Scaling Law for Language Models Training Considering Batch Size","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01505","snapshot_observed_at":"2026-08-11T00:36:58.453409Z","title":"arXiv preprint arXiv:2412.01505 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.453409Z"},"links":{"cited_paper":"/paper/2412.01505","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:00ecc936bb17b347fbf80ff06e3c399ed500303c48d1668b9161bba2df35cb05","observation_id":"478ed296-a58f-4141-93c3-4df42f4a7c39","resolution":{"observed_at":"2026-08-11T00:36:58.453409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.459715Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2021 , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.459715Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9ef8ec2c2bc16fcb8bc0c4314881bcaa66173b73cbd16ba0a52a6a967c57f231","observation_id":"6dad12ec-1d7e-45fe-b822-5e1cd2738eb5","resolution":{"observed_at":"2026-08-11T00:36:58.459715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.463918Z","title":"Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.463918Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:89b87766eb9547f0e9b45f6f447537adb3675d87ae8fea368afc20098a73f05e","observation_id":"2d3f982f-bc1b-419e-8e24-e9ce26595ab7","resolution":{"observed_at":"2026-08-11T00:36:58.463918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-11T00:36:58.468241Z","title":"arXiv preprint arXiv:2404.06395 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.468241Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:26a0564b9cae2c177b665b0c7c7ccaeeb37324041d91fe54780ad446dcad8053","observation_id":"75935f09-d0e3-4a4c-8caa-ce0798f25d62","resolution":{"observed_at":"2026-08-11T00:36:58.468241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.472683Z","title":"arXiv preprint arXiv:2512.10858 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.472683Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:07ff78c1699cc8f282c637490e72130e42c600d1a33f6adb5171e37304eb85cf","observation_id":"29c571e1-95e2-49f5-936e-90d9a605d49d","resolution":{"observed_at":"2026-08-11T00:36:58.472683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T00:36:58.476461Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.476461Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:489de2123a2083013c5260bcd3b5dd647a3851968d2ffb3ac441aec75ffd037b","observation_id":"97d01b97-159d-4b1d-b016-25632a6c467c","resolution":{"observed_at":"2026-08-11T00:36:58.476461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.480784Z","title":"arXiv preprint arXiv:2510.03280 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.480784Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7d6dc9708adf518be00e638c52c106954440aca7ad210a615887694f46bbb0fe","observation_id":"079b6332-98d0-408c-82f6-72a41eabf690","resolution":{"observed_at":"2026-08-11T00:36:58.480784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18514","last_updated":"2025-02-28T07:02:59Z","snapshot_observed_at":"2026-08-06T04:06:21.906356Z","submitted_at":"2024-10-24T08:01:22Z","title":"Scaling up Masked Diffusion Models on Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18514","snapshot_observed_at":"2026-08-11T00:36:58.484651Z","title":"arXiv preprint arXiv:2410.18514 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.484651Z"},"links":{"cited_paper":"/paper/2410.18514","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c25aa0e9bb6ce760676a22532ebb3690c2cc9ae52657c1f82744e201e95f1ce0","observation_id":"af9f02b3-3956-49f3-be39-db620d1fa309","resolution":{"observed_at":"2026-08-11T00:36:58.484651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.489110Z","title":"arXiv preprint arXiv:2602.15014 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.489110Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5e9ebe7a3011139d2bc89f32ea953f39dfc242b1bd9de478304f0b2221773451","observation_id":"a463f431-8a28-4c79-bd22-12f6899be1f5","resolution":{"observed_at":"2026-08-11T00:36:58.489110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-10T17:03:38.042994Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-11T00:36:58.493093Z","title":"arXiv preprint arXiv:2401.02954 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.493093Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:8d627ed21d3916e8d96daf8e7749677ca9affbdba92ba786218273a77f05e2d8","observation_id":"1df9f4ae-55b2-442f-a961-1f9db316aff8","resolution":{"observed_at":"2026-08-11T00:36:58.493093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.497424Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.497424Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:391e7519e2055cdcdf42d2cafa2be87dca73836c74bb7b22bfc59bf14dbab31c","observation_id":"903a6e47-ed2f-47eb-a97e-dd2f42b31203","resolution":{"observed_at":"2026-08-11T00:36:58.497424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.501845Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.501845Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:54d305d4c5a112457fac981cfff3450870b1c5623ff06a26de0470d5e15d68e6","observation_id":"ae0ac5e3-69f9-4649-ac5c-466974253b26","resolution":{"observed_at":"2026-08-11T00:36:58.501845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.505801Z","title":"Proceedings of the 57th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.505801Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:0148f83cfbc356c9df5bd53e58a7b59c399cf57d24196a37b8be42ae1d703730","observation_id":"1d5c753a-8796-4774-9e98-3f10b232938f","resolution":{"observed_at":"2026-08-11T00:36:58.505801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.13314","last_updated":"2021-06-24T21:00:28Z","snapshot_observed_at":"2026-07-06T11:22:55.799017Z","submitted_at":"2021-06-24T21:00:28Z","title":"Promises and Pitfalls of Black-Box Concept Learning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.13314","snapshot_observed_at":"2026-08-11T00:36:58.509740Z","title":"arXiv preprint arXiv:2106.13314 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.509740Z"},"links":{"cited_paper":"/paper/2106.13314","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:fe3a37166d1ea7c061e7e5e62ce738dc1cfd781adee2be6615997e4f4793fc46","observation_id":"c3d7b839-14d2-4cce-857d-831b2531fea3","resolution":{"observed_at":"2026-08-11T00:36:58.509740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04430","last_updated":"2025-02-10T19:55:17Z","snapshot_observed_at":"2026-08-06T22:57:40.145460Z","submitted_at":"2024-11-07T04:52:18Z","title":"Towards Unifying Interpretability and Control: Evaluation via Intervention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04430","snapshot_observed_at":"2026-08-11T00:36:58.513865Z","title":"arXiv preprint arXiv:2411.04430 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.513865Z"},"links":{"cited_paper":"/paper/2411.04430","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:1c4c65b0ddf8211fb965637ef4c4b36974e8200e32e4bd5e566415f4cc63a5d2","observation_id":"b8f3e0c2-2b8b-40eb-a641-d1e059477cf1","resolution":{"observed_at":"2026-08-11T00:36:58.513865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-10T14:49:08.398705Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-11T00:36:58.518062Z","title":"arXiv preprint arXiv:2501.17148 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.518062Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e92e33aaa863b1ec95c328fd08d7459b90ff33d957b6ae7d9dd1b5a8a7ceb3df","observation_id":"3bc2e44e-d022-4b63-a352-5777f5fe446c","resolution":{"observed_at":"2026-08-11T00:36:58.518062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.521973Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.521973Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:79854fec57f851d7b9badcb7206a9ca91c08b1370823e67680ce960124fe3a5c","observation_id":"0a4f21ce-367d-43ba-b915-7ce80c664b95","resolution":{"observed_at":"2026-08-11T00:36:58.521973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.527038Z","title":"Proceedings of the 26th annual international conference on machine learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.527038Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4d1eb899948d69ecdb1a087003f3ef46c7ec3bca6a553331d1da02e0c834bd8a","observation_id":"6a9bb90c-30c4-405f-b5c1-42e13b1eb16c","resolution":{"observed_at":"2026-08-11T00:36:58.527038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.530803Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.530803Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:77c1f7e069c4ee3355563a268e7f69fc79975ffe13255cdc8a401c9dfbc8a10f","observation_id":"4a6d3e80-7eb8-4b26-afcf-92ad88208119","resolution":{"observed_at":"2026-08-11T00:36:58.530803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.534395Z","title":"The annals of mathematical statistics , volume=","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.534395Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c977d47f3920f06fcfaa599ef9b4e5bdf6147dd3ebe17f337c3c873fd60b506e","observation_id":"3dce6c8b-ff78-4a71-aad9-c2d53c720a81","resolution":{"observed_at":"2026-08-11T00:36:58.534395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.538441Z","title":"Journal of the Royal statistical society: series B (Methodological) , volume=","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.538441Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:875f1aec014bf78b4cca76c88f2c50e11e777090b3314c38496aa39c9f4c5188","observation_id":"c0d58aef-ce99-4354-8ba5-4406157b8cdb","resolution":{"observed_at":"2026-08-11T00:36:58.538441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.542295Z","title":"Journal of Pharmacokinetics and Biopharmaceutics , volume=","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.542295Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:502d563ab0e330fdba3e36cc59d64674320f936f316e3c4cd283157ef402a132","observation_id":"76b464ac-de02-4b62-8dea-b4995282db05","resolution":{"observed_at":"2026-08-11T00:36:58.542295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.546296Z","title":"Social psychological and personality science , volume=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.546296Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e6f7e245d6551f3be1bce587985e0c2aae8879fcd34929adddb49df19aa78b10","observation_id":"87c673f3-484e-41f4-876b-fdd56a9e3915","resolution":{"observed_at":"2026-08-11T00:36:58.546296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-11T00:36:58.550005Z","title":"arXiv preprint arXiv:2303.08774 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.550005Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:707a9bd051bcaa70caa4113de270f46737a498aa95945f342fbc691173f25b0c","observation_id":"65707a35-9a21-48a3-a2e9-ec8fc5894cb9","resolution":{"observed_at":"2026-08-11T00:36:58.550005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.553873Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.553873Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ffcb8deb81710c1c76a76b05ad11dda75174e9dda74b69f0137528e20d9338ed","observation_id":"30100327-a4ba-4367-9f4e-45aa68bcbb23","resolution":{"observed_at":"2026-08-11T00:36:58.553873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-11T00:36:58.557843Z","title":"arXiv preprint arXiv:2403.08295 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.557843Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e9042462839d5c86be20e5341e0312454f90a83e563472e5bd0e678e8f8ff707","observation_id":"7cb6ea1d-e746-41a0-8663-08cd272ee845","resolution":{"observed_at":"2026-08-11T00:36:58.557843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-11T00:36:58.561624Z","title":"arXiv preprint arXiv:2412.19437 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.561624Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:794a6feea9cb02d55fe69ab333d88fca005389a35c759b2d6af6809d864b7540","observation_id":"5ca0c704-8be9-46b9-a512-d944156b4e85","resolution":{"observed_at":"2026-08-11T00:36:58.561624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.565605Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.565605Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:02cfb005a13c919a9b61e661f10154df2bf67069db5cc5d3edc1362eed533e3f","observation_id":"32afe517-1ec2-4a2e-befc-73416e842d5e","resolution":{"observed_at":"2026-08-11T00:36:58.565605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-11T00:36:58.569296Z","title":"arXiv preprint arXiv:2312.11805 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.569296Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4d55de4e777e70e50be74ca22ad613bae9bdb99bbdf2c64226b959095a82657b","observation_id":"525d935d-1d4d-477d-8839-17c1c0a9d8ce","resolution":{"observed_at":"2026-08-11T00:36:58.569296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-11T00:36:58.573096Z","title":"arXiv preprint arXiv:2309.16609 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.573096Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5af3a6d5849cb9f54a5271c328abdf75d0133652152d45bd8de3a742ac709c46","observation_id":"a0819fbd-5904-4107-bf61-459d1e1d01f7","resolution":{"observed_at":"2026-08-11T00:36:58.573096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-11T00:36:58.576962Z","title":"arXiv preprint arXiv:2512.13961 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.576962Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:eb6a54a433232c9770435b2f9a855a0b7bc2e84cb8eade15d5b78afd780d7ceb","observation_id":"590d1a1f-897b-4705-a3ec-7be135aa7f54","resolution":{"observed_at":"2026-08-11T00:36:58.576962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.580956Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.580956Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6b1872e370cec3fc9d7492e93bbf53f64be0e8992b5ee6b388be0dc2038b0cce","observation_id":"80e3cae1-ffc1-49b5-8936-ea230abf84a3","resolution":{"observed_at":"2026-08-11T00:36:58.580956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03736","last_updated":"2026-03-23T09:46:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T04:22:11Z","title":"Your Absorbing Discrete Diffusion Secretly Models the Conditional Distributions of Clean Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03736","snapshot_observed_at":"2026-08-11T00:36:58.584719Z","title":"arXiv preprint arXiv:2406.03736 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.584719Z"},"links":{"cited_paper":"/paper/2406.03736","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7d21e84a6c9dda8fb47e0e359f5f51597ebdb4f5fac4601ad3fc72e2da917d21","observation_id":"8ca70d5b-8257-46e5-ad48-a9b7925a1994","resolution":{"observed_at":"2026-08-11T00:36:58.584719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.589024Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.589024Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:32040b99c80fa430a48c49b313fc0a7466147b94ec35f9fc81cd04a2934d8ee4","observation_id":"baa9b3b8-9dd5-4b0a-80d2-e0ae2e766926","resolution":{"observed_at":"2026-08-11T00:36:58.589024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.592837Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.592837Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:01e99d77d89dcc961fb742226f5a9247423ce0faf6c1f217499a5c0f2ba364e3","observation_id":"84f1f7f0-4b8b-44bc-b0a9-bc11cd23d88d","resolution":{"observed_at":"2026-08-11T00:36:58.592837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17298","last_updated":"2025-06-17T17:06:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T17:06:18Z","title":"Mercury: Ultra-Fast Language Models Based on Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17298","snapshot_observed_at":"2026-08-11T00:36:58.596715Z","title":"arXiv preprint arXiv:2506.17298 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.596715Z"},"links":{"cited_paper":"/paper/2506.17298","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:33b19dbb034c6c99005294c4bf76abaf828c2c574dada9e13de3de9bdab40389","observation_id":"b6dccb48-b7da-4555-938c-55fcb7b673f2","resolution":{"observed_at":"2026-08-11T00:36:58.596715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02193","last_updated":"2025-08-04T08:43:01Z","snapshot_observed_at":"2026-07-06T22:07:21.387432Z","submitted_at":"2025-08-04T08:43:01Z","title":"Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02193","snapshot_observed_at":"2026-08-11T00:36:58.600729Z","title":"arXiv preprint arXiv:2508.02193 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.600729Z"},"links":{"cited_paper":"/paper/2508.02193","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:58643f574845816d14ff08a9ca7900934de2d72a349cb5cc2a222649b517c053","observation_id":"2c886252-65aa-4f79-a719-3884e4b85aab","resolution":{"observed_at":"2026-08-11T00:36:58.600729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.604980Z","title":"Findings of the Association for Computational Linguistics: EACL 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.604980Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:bcc6357916ea14692203f7556353b74243652c9df8fa089d23b8510d0152a3e2","observation_id":"2d99f286-db26-465a-9713-1c2293dd4d98","resolution":{"observed_at":"2026-08-11T00:36:58.604980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09573","last_updated":"2025-05-17T21:15:02Z","snapshot_observed_at":"2026-08-03T23:49:05.512328Z","submitted_at":"2025-03-12T17:43:40Z","title":"Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09573","snapshot_observed_at":"2026-08-11T00:36:58.608734Z","title":"arXiv preprint arXiv:2503.09573 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.608734Z"},"links":{"cited_paper":"/paper/2503.09573","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7e4fe05126f690c7cae3bac04752a3064a7db117f65435d225e176ae0b257b14","observation_id":"1101566a-be80-4cfa-a8fc-c67c253531bd","resolution":{"observed_at":"2026-08-11T00:36:58.608734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T00:36:58.612743Z","title":"arXiv preprint arXiv:2209.10652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.612743Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a3b46a7c398f30ffc9134eeb27814908e914a50f39dd44d6bfcba7ce7bdf412e","observation_id":"454e4a56-d4f8-48d8-8f80-d553c9061d31","resolution":{"observed_at":"2026-08-11T00:36:58.612743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.616782Z","title":"Transformer Circuits Thread , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.616782Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:056a9b808e83c1acc75f15df565dbf7e533fbd71c8f4d50579da57e79147b7fb","observation_id":"8e404870-a582-4641-84ca-9b11d60a4c3f","resolution":{"observed_at":"2026-08-11T00:36:58.616782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.620930Z","title":"Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.620930Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a686ed0bdbcee0e122f31088e3093527c4b1dd671a039d293b8407e8127ee4c4","observation_id":"0daabdb8-c5c6-4ad5-934a-5ebd1869ad48","resolution":{"observed_at":"2026-08-11T00:36:58.620930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.624686Z","title":"2025 , journal=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.624686Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:93a1c2672af35a872998735dd07a4ecb384c8a91ac2ebf5d6b6d748a385cb071","observation_id":"b158920a-768d-4ec0-b7e4-91ad927e0bc6","resolution":{"observed_at":"2026-08-11T00:36:58.624686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.628285Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.628285Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:48686ecbb77e8fc395ebf25472b10ac062f7fa4f1a9ca9060ae96ce9eab6e4b3","observation_id":"e6b3f84b-5b01-4faa-8264-60592c32fc26","resolution":{"observed_at":"2026-08-11T00:36:58.628285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.632085Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.632085Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a7660bb09a1dcb8034d84b6c3b2f06ef66151b7a81c360986e1d0c1a1d73bdb0","observation_id":"dbbb0662-8aa5-4d39-a37e-301007a0e567","resolution":{"observed_at":"2026-08-11T00:36:58.632085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.635768Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.635768Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3e7476f9a71e861b666ad8c0a693713d9ace0a8c13476317e8b980438df0ec34","observation_id":"38340329-2017-4565-998b-47227341bec3","resolution":{"observed_at":"2026-08-11T00:36:58.635768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.639387Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.639387Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:354f558d07311304fe67a8c000b1e183f0a8e599de7012b6cde9c71714f9ad67","observation_id":"6006fbfe-cbd7-4153-ae18-f9d77946bfb6","resolution":{"observed_at":"2026-08-11T00:36:58.639387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.642761Z","title":"arXiv preprint arXiv:2506.10892 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.642761Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6a5987b5918492ed28483b9adb67740ae2e5b42b15a8269b0ada9d6911862080","observation_id":"fa78121d-a5ff-4e02-8473-8fb17d9a5239","resolution":{"observed_at":"2026-08-11T00:36:58.642761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01928","last_updated":"2026-08-05T00:02:32Z","snapshot_observed_at":"2026-08-08T23:08:57.113826Z","submitted_at":"2025-06-02T17:47:27Z","title":"Esoteric Language Models: A Family of Any-Order Diffusion LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01928","snapshot_observed_at":"2026-08-11T00:36:58.646253Z","title":"arXiv preprint arXiv:2506.01928 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.646253Z"},"links":{"cited_paper":"/paper/2506.01928","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e579712082906780b2093d37dcf1738294fee0c509c0291bf4a02b2fb45cbf6c","observation_id":"1ac576a8-8784-445f-baac-83747506b7cb","resolution":{"observed_at":"2026-08-11T00:36:58.646253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-11T00:36:58.650247Z","title":"arXiv preprint arXiv:2308.10248 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.650247Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:688b76301a1e7780558bfb6eb3d749f0258a47b9d502e9ffa97e714e67236cbc","observation_id":"eb76b229-a91c-4a0e-8cdf-e1f5beafa000","resolution":{"observed_at":"2026-08-11T00:36:58.650247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.653751Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.653751Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:1289b966ff989650eb6481fd19332aa54cafa329d9309ab41ffefcf26dc36db6","observation_id":"02e3e126-6dfb-4780-ba3b-b0d09865e792","resolution":{"observed_at":"2026-08-11T00:36:58.653751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-11T00:36:58.657462Z","title":"arXiv preprint arXiv:1610.01644 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.657462Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:2b6730f61519a184c59ce2be94448c5889d2a170b780836e04ca7d255f94305c","observation_id":"6199a7c6-f3f9-43f1-87b3-5993f0aed4b4","resolution":{"observed_at":"2026-08-11T00:36:58.657462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.661301Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.661301Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:1786d04a69a2eed016d6580690ae2ef01e68f0e6942db0dffe2454e7631fe120","observation_id":"d165b11b-e838-4e6a-a0f4-13e512cdfc3a","resolution":{"observed_at":"2026-08-11T00:36:58.661301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-11T00:36:58.664963Z","title":"arXiv preprint arXiv:2310.01405 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.664963Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:2cb43b78743d772554ececf0590890970f7d8bf07c4332c9c70ef98e38a5d5c1","observation_id":"aac6f879-afe1-4e8e-9a30-c19fa1aef878","resolution":{"observed_at":"2026-08-11T00:36:58.664963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.668737Z","title":"2024 , publisher=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.668737Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:56ed223cb13a6f7133d6970f6dbe7375bef5c524b81cf56996f169f16bde30bc","observation_id":"df021274-a922-4a5a-abaa-55f1f31c599f","resolution":{"observed_at":"2026-08-11T00:36:58.668737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.672355Z","title":"Nature machine intelligence , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.672355Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:4092e61e58f1c762483856795a8f5f194a5e785b1016a60fe11887ecf8338515","observation_id":"d6efa557-2340-44d5-b633-cb5717f058e8","resolution":{"observed_at":"2026-08-11T00:36:58.672355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.08608","last_updated":"2017-03-02T19:32:10Z","snapshot_observed_at":"2026-08-07T08:20:39.814613Z","submitted_at":"2017-02-28T02:19:20Z","title":"Towards A Rigorous Science of Interpretable Machine Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.08608","snapshot_observed_at":"2026-08-11T00:36:58.676160Z","title":"arXiv preprint arXiv:1702.08608 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.676160Z"},"links":{"cited_paper":"/paper/1702.08608","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:d47eb98421c97292cd96721683339192aa8ad4337247b048ec6bd3b193e2bc9f","observation_id":"848feaa0-1bc1-42f5-a9a1-c9f46a41d426","resolution":{"observed_at":"2026-08-11T00:36:58.676160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T00:36:58.680147Z","title":"arXiv preprint arXiv:2206.07682 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.680147Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:8f404c7e226b877c960d309ae05d5778403e51ac7b717a7fa127006824e3eac9","observation_id":"b6c6fd73-ce04-4543-a310-a108c9418fbe","resolution":{"observed_at":"2026-08-11T00:36:58.680147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.683999Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.683999Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:c3b4baf83cadd2e8ff986edf423b3c4e52eeff20e726aa1358ae590c78028be9","observation_id":"d30eadff-ce37-48aa-ba9a-3432e53c5ccb","resolution":{"observed_at":"2026-08-11T00:36:58.683999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-11T00:36:58.687809Z","title":"arXiv preprint arXiv:2311.03658 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.687809Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:bb838a775fb2b8dc0d255c4757b73b3ebd99164a0bf282878fd1db51ea55eeff","observation_id":"ae64a33b-a5aa-44fa-90e2-d1043db9d9a6","resolution":{"observed_at":"2026-08-11T00:36:58.687809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.691731Z","title":"A is B” fail to learn “B is A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.691731Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:6383010860aa0b38ba0e8c844d560d95bfbb35ef2b216b303d2e07f024e30244","observation_id":"d8b5769f-1a06-4a77-8d56-3dc529d796da","resolution":{"observed_at":"2026-08-11T00:36:58.691731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.695269Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.695269Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:91bac8e4ff7810ad5a489655f9110b8a90b37ab01a0c45bb710c7f6586549a91","observation_id":"01d05d4a-930a-41e6-9f52-2c9dfeb29d2a","resolution":{"observed_at":"2026-08-11T00:36:58.695269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.698865Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.698865Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:508ee7345d7ed04d258985df71d75d203157e0ee5994d56f790a07ae948b87e9","observation_id":"d9447e02-9eff-4efd-8330-ce004eff61cb","resolution":{"observed_at":"2026-08-11T00:36:58.698865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.702709Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.702709Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:16e87a534d4ccd9b0b0890d34cc5130b93f140c451b862cc72f5098dc3da6f8a","observation_id":"1a704b34-0cf7-40ba-aa20-9515d7d4b4df","resolution":{"observed_at":"2026-08-11T00:36:58.702709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.706599Z","title":"2023 , howpublished =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.706599Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:5fcd70785a16c6cccadda699fed484d55f8b86b1b90072d68a741896a5a70809","observation_id":"fcd2e860-2383-4fae-9f76-26b36fdfd1f0","resolution":{"observed_at":"2026-08-11T00:36:58.706599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.710591Z","title":"GitHub repository , howpublished =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.710591Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:12b32c11158c20762c5fb9d2d29ab284de6a18f3fb1c6abef6e55095a2521b22","observation_id":"28d33b06-5612-4c3f-a3bf-0a1ae97f534a","resolution":{"observed_at":"2026-08-11T00:36:58.710591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.714240Z","title":"Cryptographers’ track at the RSA conference , pages=","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.714240Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b617d53e4e914974e8eedab28c9f17a69ce7f0b72df3394d161fb76915a1ecad","observation_id":"d379ed9d-40e9-4ed0-b05d-a3727abf864b","resolution":{"observed_at":"2026-08-11T00:36:58.714240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.717873Z","title":"Scientific american , volume=","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.717873Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:ed255f35c22c63607990e4f67d2aa61553a9c6c7d6dd4f17d9af301300ac135d","observation_id":"a052f412-de7e-46d2-a404-c2b007547174","resolution":{"observed_at":"2026-08-11T00:36:58.717873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-11T00:36:58.721501Z","title":"arXiv preprint arXiv:2305.06161 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.721501Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9bf433a9ba6f159090c7dfd13556a9a42fa36dbb1d36039321ef113e2e1ef2b8","observation_id":"9f1db654-54c4-4e63-8de9-36b011961aef","resolution":{"observed_at":"2026-08-11T00:36:58.721501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.725538Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.725538Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:12568d573dd85cbab05a999714cf3d56f910971b1afd2558f1d459d7c622ffae","observation_id":"2736c428-14f6-4fad-93ff-0b23159f7c34","resolution":{"observed_at":"2026-08-11T00:36:58.725538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.729330Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.729330Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:32a41acf50f3723b852840730669142ebbb944f9e5065c78cd6cfdc516031387","observation_id":"5ef5289f-404e-4e4c-a7de-f61b7a4ade9b","resolution":{"observed_at":"2026-08-11T00:36:58.729330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-11T00:36:58.733264Z","title":"arXiv preprint arXiv:2310.10631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.733264Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3f6e9c49af1938ad943e66a7cdafb17dd457cf3090c3856e41ae485ca9e7e30f","observation_id":"131490c0-125d-4de1-aaa4-374c5020ee55","resolution":{"observed_at":"2026-08-11T00:36:58.733264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.737069Z","title":"2026 , month =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.737069Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:f307171b4f7fbafd490a717e50fe91dbcfd349f6d18af34d69395878ab5bc4b3","observation_id":"73076905-61b8-4ae0-a923-7b33142f40e3","resolution":{"observed_at":"2026-08-11T00:36:58.737069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.741065Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.741065Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:41f00e6a5fd2bd55f9a0a32cdd192f21a826fdbe3e4f50f35c8b295a6df50653","observation_id":"6444b19e-7ad6-4ba1-98f8-179447161d04","resolution":{"observed_at":"2026-08-11T00:36:58.741065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-11T00:36:58.744657Z","title":"arXiv preprint arXiv:2101.00027 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.744657Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9ea92848a2edaa7451ebb0b0988c4fae50e1acc91f1a73e38cfedcd618509384","observation_id":"a8ef7112-9410-47b2-8161-794f5d024bfd","resolution":{"observed_at":"2026-08-11T00:36:58.744657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-11T00:36:58.748607Z","title":"arXiv preprint arXiv:2009.03300 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.748607Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:7fe11db7656564fa83ffab3300a1cf55172f8c5489d536a3dbdab0ce65a86981","observation_id":"70cbfe3c-6d8d-4dae-a25b-b96e87c86df5","resolution":{"observed_at":"2026-08-11T00:36:58.748607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.752584Z","title":"Nelson and Ku","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.752584Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:9793792dee27c778c9ef3f2cdcff867e5e8ad308f2f006ecf5fb645e8f8192a7","observation_id":"56c72ea9-33df-4243-b9b3-8eedf88c2933","resolution":{"observed_at":"2026-08-11T00:36:58.752584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.756401Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.756401Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:f2bb400f017eadce6280d845eac8040b9b92c95390d43e8f2dad1c16bf8da33f","observation_id":"39cee7d0-d90f-4592-9302-958ec7223ddc","resolution":{"observed_at":"2026-08-11T00:36:58.756401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.760110Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.760110Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:0f1bc69ab04e8ab50393f4d49b82f2592d9bf7f8bcaf3713658a37fd32a7fc88","observation_id":"8adc7414-1744-476a-a688-0649d09575a5","resolution":{"observed_at":"2026-08-11T00:36:58.760110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.763869Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.763869Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:a7000190f08c2ee91e388f36334c69b47d0aa39bc0452f5c50954b6affe08584","observation_id":"946be5cf-e39c-48e3-b277-0129d85fc076","resolution":{"observed_at":"2026-08-11T00:36:58.763869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06129","last_updated":"2023-06-05T17:33:43Z","snapshot_observed_at":"2026-08-10T19:17:28.096908Z","submitted_at":"2023-04-12T19:27:09Z","title":"Label-Free Concept Bottleneck Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06129","snapshot_observed_at":"2026-08-11T00:36:58.767568Z","title":"arXiv preprint arXiv:2304.06129 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.767568Z"},"links":{"cited_paper":"/paper/2304.06129","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:2ef04dd5c4b0c2a9d80e0ec02c771b6bd3cc5eea541096d8169137c3c48a03ae","observation_id":"bcb0d6f2-3973-47b5-a8d3-b1df41fcc32b","resolution":{"observed_at":"2026-08-11T00:36:58.767568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.771826Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.771826Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:bdf0fc3bd09ed91bc4189f508bc53b3de542b5c336594f1a5746a6d418fe2d62","observation_id":"1d68cabd-83ea-418d-8302-009403e77ced","resolution":{"observed_at":"2026-08-11T00:36:58.771826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06068","last_updated":"2024-11-09T04:57:41Z","snapshot_observed_at":"2026-07-06T19:47:47.232714Z","submitted_at":"2024-11-09T04:57:41Z","title":"Zyda-2: a 5 Trillion Token High-Quality Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06068","snapshot_observed_at":"2026-08-11T00:36:58.775332Z","title":"arXiv preprint arXiv:2411.06068 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.775332Z"},"links":{"cited_paper":"/paper/2411.06068","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:236086b211729b11c5c8811d21795f73a7896a21b723d56d49d6c0b6c6c9c126","observation_id":"06b14b64-3bb0-472d-94cd-163d1c10f23e","resolution":{"observed_at":"2026-08-11T00:36:58.775332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.779385Z","title":"Proceedings of the 58th annual meeting of the association for computational linguistics , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.779385Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:3f6061d39811baef39e80f9659da93a9b07ca1c4264f1c06bd48c774bfa58d60","observation_id":"26626bd1-c9bc-4d3d-878a-039a6c37f7cf","resolution":{"observed_at":"2026-08-11T00:36:58.779385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.783239Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.783239Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:58156963f63add54b2a4f4314d79e581a716ca67ad9e6deb8f5babfffad75ae6","observation_id":"ff63b0ee-f88b-4dab-b8cd-3cf1bd09aec0","resolution":{"observed_at":"2026-08-11T00:36:58.783239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-11T00:36:58.786983Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.786983Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:e51921456f9fd089ab6e9b0c825275d5bf804bb60387da7ab867438fb110646f","observation_id":"8174b139-d584-466b-984c-ccb5f03f7023","resolution":{"observed_at":"2026-08-11T00:36:58.786983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.790725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.790725Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:035c9e0572f2637d1b095911beafc1b4b85d90bdd8fd7187c8b87142ee9ae14b","observation_id":"d0daf3df-f185-45f5-a352-bb138a965296","resolution":{"observed_at":"2026-08-11T00:36:58.790725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.794361Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.794361Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:de7d6575d598006ac6973de200a9020e04108f6f585c0efc3112725ed6b582d5","observation_id":"79663dc9-0359-4c43-b18d-07a0d03956ff","resolution":{"observed_at":"2026-08-11T00:36:58.794361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-08-09T13:23:52.437582Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-11T00:36:58.797964Z","title":"arXiv preprint arXiv:2506.05176 , year=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.797964Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:05449d441932063661a1233afcb4964a0a4bdcda840e6d6a83831ebba9cb342b","observation_id":"f7791534-b14a-417f-893b-bd4c6fc5e543","resolution":{"observed_at":"2026-08-11T00:36:58.797964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:36:58.802066Z","title":"IEEE transactions on big data , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-11T00:36:58.802066Z"},"links":{"citing_paper":"/paper/2608.07594"},"observation_digest":"sha256:b624f429272739f8104bc005a3a725330a35e3537c8e3ad1b963b76e02a4d075","observation_id":"cfb6723d-d4a7-4d02-aff4-b2fe88f136a9","resolution":{"observed_at":"2026-08-11T00:36:58.802066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07594","last_updated":"2026-08-06T04:29:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T10:13:21.434010Z","submitted_at":"2026-08-06T04:29:58Z","title":"Scaling Inherently Interpretable Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":193},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 193 outbound references and 0 inbound Pith citation observations for arXiv:2608.07594."}