{"as_of":"2026-08-15T19:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2691fcab723ea5a2f5c6b39cd2e8318f10a923f08f3dbe90545f51eef071947","coverage":[{"denominator":151,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:16:17.075444Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10260/citation-record","integrity":"/paper/2608.10260/integrity","json":"/paper/2608.10260/citation-record.json","paper":"/paper/2608.10260"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.383636Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.383636Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:cc117387864a5044f3a1b18d714543883cb1f1357896c592cc30ec45f09d9550","observation_id":"25045826-422e-46a4-b099-4459a25e2442","resolution":{"observed_at":"2026-08-14T04:16:16.383636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.390977Z","title":"PLOS ONE , publisher =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.390977Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8da81ad48de3866a210b138f53a3963617b1637e8fb4c01ca8fd5eb591398e65","observation_id":"21e89d6f-450b-495b-a753-90dda5c371f4","resolution":{"observed_at":"2026-08-14T04:16:16.390977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.05950","last_updated":"2019-08-09T15:51:47Z","snapshot_observed_at":"2026-08-14T16:32:08.594751Z","submitted_at":"2019-05-15T05:47:23Z","title":"BERT Rediscovers the Classical NLP Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.05950","snapshot_observed_at":"2026-08-14T04:16:16.409090Z","title":"1905.05950 , archivePrefix=","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.409090Z"},"links":{"cited_paper":"/paper/1905.05950","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3e06b7944d74c7ded71eac0e5dd5b11976f37f96bd782f52af61039cb685e89f","observation_id":"38e22406-ad5c-44e3-ac1d-8db53842d43c","resolution":{"observed_at":"2026-08-14T04:16:16.409090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.418115Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.418115Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2513b0a84ecdb5c758e6e42f6baea23a2c8218c4ba510d793f9b52413f7ad1b9","observation_id":"cefc9979-6be3-4626-b5e8-c207de1ac71e","resolution":{"observed_at":"2026-08-14T04:16:16.418115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.448118Z","title":"Interpreting","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.448118Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0b568022c9b71865cfd38a355495e6ef5ecf7bf0b8198110981d83c418deb0f5","observation_id":"79d82990-ece9-444f-bbb1-674783c18c43","resolution":{"observed_at":"2026-08-14T04:16:16.448118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.452666Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.452666Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6b9c3789f9c67fe22e8c14d00c3634818db550ed98539c8155b9de6e5a033c4a","observation_id":"f104aafc-0331-469f-8c2f-3fb0f7dfddae","resolution":{"observed_at":"2026-08-14T04:16:16.452666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.456564Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.456564Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:43d703e35c6f839e7781c5eeda769b1d1ae3f71f58956cd2859839d01ac78e13","observation_id":"6e6ed633-44ec-4339-9e5d-a3e80a7549db","resolution":{"observed_at":"2026-08-14T04:16:16.456564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.461698Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.461698Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:aa1b20a7875632b8773b12a8c1329ae46fe206358d2ae9405e7aaa8ef777e5e8","observation_id":"14a17403-fa07-4d83-b0b6-15b21ada7ed1","resolution":{"observed_at":"2026-08-14T04:16:16.461698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.472590Z","title":"and Ducharme, R and Vincent, Pascal and Mathematiques, Centre , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.472590Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6e031570c6234b79761b711cf2aea3bfcba94006701e13f86d0bbf67ac0f31d6","observation_id":"2b6c85c7-04a5-4e78-8e52-fdb42a19970a","resolution":{"observed_at":"2026-08-14T04:16:16.472590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.478458Z","title":"2013 , eprint=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.478458Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8f67ec74ad24c84ca711da032a8d0509c60b41325d11b48f63ec1c3f3e32f591","observation_id":"dbf42622-2c31-474d-aa7e-01371f0abc2f","resolution":{"observed_at":"2026-08-14T04:16:16.478458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.483996Z","title":"G lo V e: Global Vectors for Word Representation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.483996Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2d96e0b8f1aa03fa585a15ed6b4f1a344e663833a7cd41aac3afc610ae78b783","observation_id":"6e702ae6-1a7e-4bca-9db9-c40830fb3ffb","resolution":{"observed_at":"2026-08-14T04:16:16.483996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.490619Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.490619Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c6ee8664a371cf986e27e2115d83c698e993439bda20f4b0a8971e5c13c66512","observation_id":"e8fd2ed5-7b25-474f-8d0e-dcbe9447cd34","resolution":{"observed_at":"2026-08-14T04:16:16.490619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.509294Z","title":"C Users J","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.509294Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a54d062d66a1f4dc36ab72c28eb99f375e70f2f3c9204745cd35485e1a75a556","observation_id":"4ec5043e-cf1d-4fd4-b868-92de3d30cac9","resolution":{"observed_at":"2026-08-14T04:16:16.509294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.516480Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.516480Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2c35d0b2ea133883d16458cceabb0c3b41b19a40df2df5126b9a31e053329e53","observation_id":"4e5456aa-2f43-4ddc-a98f-91c4f58ee72c","resolution":{"observed_at":"2026-08-14T04:16:16.516480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.527512Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.527512Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7566d1e66d56a4d059b695073af775b814856e56d2bcd336b78bddd2772d44ee","observation_id":"823ef9c7-ad5d-483b-894e-9cd4ee181b22","resolution":{"observed_at":"2026-08-14T04:16:16.527512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-08-14T03:33:46.294739Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-14T04:16:16.533862Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.533862Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2f5c8bdfa10c5c2dc04d9c123b16c2a70f7d36d007b0f6db0b3981608dfaf97e","observation_id":"3ba81c5c-137f-4466-8219-f5ee945963d6","resolution":{"observed_at":"2026-08-14T04:16:16.533862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-14T04:16:16.538208Z","title":"Fu and Stefano Ermon and Atri Rudra and Christopher Ré , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.538208Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:5a07f1e90c9a957cfa48abc20f32f64aa22d6ad8dc5b0d756c27bfa5b27b73b3","observation_id":"3cda7172-8cb6-47bb-a8a5-1db38604ba11","resolution":{"observed_at":"2026-08-14T04:16:16.538208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-14T04:16:16.543145Z","title":"1810.04805 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.543145Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:fdb067a97b01e6e76b2f494dead030802c87e16d8b7ce4ab497ea3e346e81dff","observation_id":"6e48e81c-2e66-48b7-b5e1-90ba92a9fb33","resolution":{"observed_at":"2026-08-14T04:16:16.543145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.552037Z","title":"and Zipser, David , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.552037Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b3807d83792d6353bf02f0978793326b20627edd8c3c4c5cde6ae146ef1cfb47","observation_id":"15cf7347-44af-4c0b-8dfc-c5a624c15324","resolution":{"observed_at":"2026-08-14T04:16:16.552037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.556800Z","title":"2001 , eprint=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.556800Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:d42a9f7123888fbf67602329d140401ab64b0c4c11e77d01da1663dc23dc0a31","observation_id":"cf6a7188-cc13-46b9-892d-c68ce48a81de","resolution":{"observed_at":"2026-08-14T04:16:16.556800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.563326Z","title":"OpenAI Blog , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.563326Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:ec054afe4fa1b2f3247986eeba61d38cdcfef11a0e8b47a7a0b3a38bc538e9d1","observation_id":"92844c8f-be9b-499a-8758-7997a7986032","resolution":{"observed_at":"2026-08-14T04:16:16.563326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.568337Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.568337Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b581bbc884cefd68515fede88e007980bff7bde618edb7dbfda2373d6ee0b43f","observation_id":"02822102-463b-4d45-a225-351e04e9b0a0","resolution":{"observed_at":"2026-08-14T04:16:16.568337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.572978Z","title":"1954 , url=","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.572978Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a5259e6fa9b582fed0dd19235533850cbb5b4a3c9913f6f6218696bc96070c60","observation_id":"80d8ba48-d42c-4bec-be08-aea5ef5a785f","resolution":{"observed_at":"2026-08-14T04:16:16.572978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.577887Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.577887Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:2422f282621472966d33e25fa51b30b8d2a864260c526df01cecd25d8829f5b8","observation_id":"48ee2d37-59a7-4d77-87a0-0417770166a8","resolution":{"observed_at":"2026-08-14T04:16:16.577887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.581813Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.581813Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:953bd008ce50174d3d70e136f6f51e5a1ed3da55f9e18f0e5684d65d62387933","observation_id":"dea0743c-3e27-41a8-8942-8ac779fa45fb","resolution":{"observed_at":"2026-08-14T04:16:16.581813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.588109Z","title":"Why Should I Trust You?","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.588109Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:aade311a70f86ab4d918fcd7c0a30c54cdd8f49c71618f7cb3e4cb7f7da4e057","observation_id":"19ae1910-164e-4393-b31c-3d07c564eaca","resolution":{"observed_at":"2026-08-14T04:16:16.588109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-14T04:16:16.592517Z","title":"Hu and Yelong Shen and Phillip Wallis and Zeyuan Allen-Zhu and Yuanzhi Li and Shean Wang and Lu Wang and Weizhu Chen , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.592517Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c330421a17a321d0c2699b7ce780f4ccc5861c5413a38bb70ea926311c6d9330","observation_id":"b872518d-c041-4f73-99e0-586e86f480ae","resolution":{"observed_at":"2026-08-14T04:16:16.592517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.601319Z","title":"R eal T oxicity P rompts: Evaluating Neural Toxic Degeneration in Language Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.601319Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7b107eee7d6767f15088e4796bc4a3c3e55d0e7e1bd26e908c914f3ef563aa44","observation_id":"0bb244f0-270b-4d44-93f2-b68ef386888a","resolution":{"observed_at":"2026-08-14T04:16:16.601319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.607347Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.607347Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7353163f372196bb0b625b7de72973fa9d7bc3e80cfe7e66730b61c5bbd3953c","observation_id":"3466e1ea-d7dd-4ba7-a515-de771fbb673b","resolution":{"observed_at":"2026-08-14T04:16:16.607347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.612787Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.612787Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:45c06b3ddd9a76847b29927e946e052e4b1715ea8d334e9f1fc9c39a6c509757","observation_id":"dac58048-2643-4b7f-a748-b91f679bb87f","resolution":{"observed_at":"2026-08-14T04:16:16.612787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.618785Z","title":"and Gebru, Timnit and McMillan-Major, Angelina and Shmitchell, Shmargaret , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.618785Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:ffe2500801a7355171458a689594d5a4a852186a2f8b9b8b3d50d166297e1988","observation_id":"cc92aa37-c254-49e7-8b5f-1759761f462d","resolution":{"observed_at":"2026-08-14T04:16:16.618785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.643851Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.643851Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7695733822c5e004a782a68459707fccb63625a0d62ee90542532c18d22bcb03","observation_id":"41818f71-3eb5-4edb-ba18-46521d414fa9","resolution":{"observed_at":"2026-08-14T04:16:16.643851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.650899Z","title":"IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.650899Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:99a9e9a5809cd0dea98980f679b0484534e84bcd93371205e542d154282d2371","observation_id":"43ec8eab-9daf-4b25-9e48-4b11e1adb39f","resolution":{"observed_at":"2026-08-14T04:16:16.650899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05602","last_updated":"2024-06-10T09:58:55Z","snapshot_observed_at":"2026-08-14T01:04:21.926925Z","submitted_at":"2024-02-08T12:01:24Z","title":"AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05602","snapshot_observed_at":"2026-08-14T04:16:16.656408Z","title":"2402.05602 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.656408Z"},"links":{"cited_paper":"/paper/2402.05602","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:34ac36f142969f1a845661d5804a0764cdfa4a7918cf5cb64cda514a5f54e8f2","observation_id":"a1b0f625-788f-45fd-bdae-d3b32d8a8084","resolution":{"observed_at":"2026-08-14T04:16:16.656408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.661346Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.661346Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c001f4abc1f3ae2b27cb6f174d928c877d6824be61da777babec8fafd0084558","observation_id":"559d53dd-5c3f-4278-ba70-ba47a2ad583f","resolution":{"observed_at":"2026-08-14T04:16:16.661346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.667449Z","title":"2018 , eprint=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.667449Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:f1d1c461c6ee7cbc38d0bcac0af694369586ef33c6c61c7b308b7347da6458ed","observation_id":"33838d78-22fb-498a-acee-da9ff83c2dd5","resolution":{"observed_at":"2026-08-14T04:16:16.667449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.672490Z","title":"2024 , url =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.672490Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:e4ad87c99d05bd87fa6b7fd35c91fa8d9b35842760edfed64fb348ede1a9ac8a","observation_id":"89a17ae6-6069-45a0-aab4-9e164503a2dd","resolution":{"observed_at":"2026-08-14T04:16:16.672490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.677658Z","title":"2021 , journal=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.677658Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:25e6c671d90856f26951e3850b61e066caeae6633912ca42e0b3cff375d58c0a","observation_id":"fd860d6d-a4c7-4421-868a-9c597c3aeab6","resolution":{"observed_at":"2026-08-14T04:16:16.677658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.00586","last_updated":"2023-11-02T10:55:18Z","snapshot_observed_at":"2026-08-14T07:59:25.068582Z","submitted_at":"2023-04-30T21:44:21Z","title":"How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.00586","snapshot_observed_at":"2026-08-14T04:16:16.681575Z","title":"How does","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.681575Z"},"links":{"cited_paper":"/paper/2305.00586","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:72568184db51db98a12f2e5bfca39853ac5eaaba292172e8472c4bc5d20b5298","observation_id":"23d0846f-0e7c-4727-b854-851bfcde96e6","resolution":{"observed_at":"2026-08-14T04:16:16.681575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-14T04:16:16.686097Z","title":"Interpretability in the Wild: A Circuit for Indirect Object Identification in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.686097Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:bfa483a1d269b172db7fb03fde45274c0afa5e844b29e662f67994c83b4e6cab","observation_id":"647a7e18-b281-4e58-ad4b-0b1d6bfd0c84","resolution":{"observed_at":"2026-08-14T04:16:16.686097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.692822Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.692822Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a8128c0ba755a7d897c09c6c5ff8407e5bb0534e1b30943479bd8449fbc3e04d","observation_id":"bc7f7fa8-d1db-472c-aee5-3d731e3ef4fb","resolution":{"observed_at":"2026-08-14T04:16:16.692822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.702756Z","title":"GitHub repository , howpublished =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.702756Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:37d6b31352c1159633888d23ab1a381a7096a2f400195f8e2df0bd95883b4711","observation_id":"df272c73-68e5-4e7f-8cbd-2f9f8d719201","resolution":{"observed_at":"2026-08-14T04:16:16.702756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.707557Z","title":"Orthrus Toxic Dictionary implementation , howpublished =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.707557Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:4ed580014d29cb46e30916deb186a747c8c583cbc2885391db3948964bc3fe03","observation_id":"bac6df61-4996-4c16-9109-1fb0a5332348","resolution":{"observed_at":"2026-08-14T04:16:16.707557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.719036Z","title":"The IEEE International Conference on Computer Vision (ICCV) , month =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.719036Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:91dfe1c7060567d969ad5d13406d015799df7b8cd4d237ed543bbc33457b7a63","observation_id":"2f494b6c-60dd-4f56-8bd4-86576918292f","resolution":{"observed_at":"2026-08-14T04:16:16.719036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.727125Z","title":"2017 , howpublished =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.727125Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6ba64fbb0f186e0751b1ff1621860af791d26f2deebb99cc7f4a9861587a8620","observation_id":"fa3e5950-4330-4616-a4c3-4f570c5e5232","resolution":{"observed_at":"2026-08-14T04:16:16.727125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.733701Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.733701Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:fe5dd1c2cfaf387eab5d111f28b321b2556a974f3ac5af6ba6a95277c23483bb","observation_id":"0a3f0a79-4fae-4a92-9b65-2f4aec6a4523","resolution":{"observed_at":"2026-08-14T04:16:16.733701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T04:16:16.738531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.738531Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7752b8c8c6a94ead427975e8ba2ca8d3e89f1d56f2bd1dc972f0a493a60e1df4","observation_id":"5b1a56b3-2852-4cc8-8708-163f4884074e","resolution":{"observed_at":"2026-08-14T04:16:16.738531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.747230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.747230Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:b104e3e61a46891227fd2f0ff4fb5ce8dfa839ffc2f5b9d1baf55dcc4c263c6c","observation_id":"9e2800c1-f4ac-49ad-aa2d-d18ae0e8f88c","resolution":{"observed_at":"2026-08-14T04:16:16.747230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.751173Z","title":"AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.751173Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3c014f64a09181829d386eefcbb3eaf260e2e312e1641b821200249c4529dc09","observation_id":"f19ac581-d6ff-4ef5-b1a3-db911c1cf567","resolution":{"observed_at":"2026-08-14T04:16:16.751173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.756189Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.756189Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:4d7fdb9921f762e6a962ee6bfc3a340251c94c49df624933a6a8f9a836208967","observation_id":"ac304d72-aac1-48d9-93c6-32fcebb9594a","resolution":{"observed_at":"2026-08-14T04:16:16.756189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.02860","last_updated":"2019-06-02T21:21:48Z","snapshot_observed_at":"2026-08-14T17:33:04.904744Z","submitted_at":"2019-01-09T18:28:19Z","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.02860","snapshot_observed_at":"2026-08-14T04:16:16.761405Z","title":"Le and Ruslan Salakhutdinov , year=","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.761405Z"},"links":{"cited_paper":"/paper/1901.02860","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6f7a396ac8b4f50e4fb6e31b1a266eefe6be65cd2a81e9619ae34807b3d0c7f0","observation_id":"0f56a8c2-2dfa-44c4-9676-b3147bf20955","resolution":{"observed_at":"2026-08-14T04:16:16.761405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.766529Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.766529Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:f1476ffce5f21604f38b95b79e10d2cff81897b6d33fe5a1cb1a59cae1defd34","observation_id":"57b496dd-2d36-4323-9442-27d4bb7a1207","resolution":{"observed_at":"2026-08-14T04:16:16.766529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.770619Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.770619Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1a5ec3ce6c866ab218e4ded9885a31c3da4dacf554154b4882610494cc3255b8","observation_id":"b350379e-a823-4067-9bfe-aff34449b58a","resolution":{"observed_at":"2026-08-14T04:16:16.770619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.776226Z","title":"2021 , eprint=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.776226Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:676a2ca68daee040bc19e953f254afafe5c4f913f50a57b0035a07b585969b71","observation_id":"ffe542e7-42a6-4a43-9046-75336969bad4","resolution":{"observed_at":"2026-08-14T04:16:16.776226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14875","last_updated":"2025-01-24T01:15:16Z","snapshot_observed_at":"2026-08-15T11:47:35.796445Z","submitted_at":"2024-02-21T18:25:25Z","title":"What's in a Name? Auditing Large Language Models for Race and Gender Bias","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14875","snapshot_observed_at":"2026-08-14T04:16:16.779811Z","title":"What's in a Name?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.779811Z"},"links":{"cited_paper":"/paper/2402.14875","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1d828786e868162aa1e7e22197948f462edd0dc9ce886342e81f0915c0f2f938","observation_id":"04c7bafe-2e99-4c5f-b85f-537916f2520b","resolution":{"observed_at":"2026-08-14T04:16:16.779811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.784211Z","title":"2020 , isbn =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.784211Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:50d88e38c33f6db64c6f12089ad18f4e346b41dde18a21ef450eb247672ffbb8","observation_id":"15f0677e-62d7-4d41-836f-90591b5a6c03","resolution":{"observed_at":"2026-08-14T04:16:16.784211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04897","last_updated":"2023-11-08T18:56:35Z","snapshot_observed_at":"2026-08-13T05:29:38.854663Z","submitted_at":"2023-11-08T18:56:35Z","title":"Future Lens: Anticipating Subsequent Tokens from a Single Hidden State","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04897","snapshot_observed_at":"2026-08-14T04:16:16.789598Z","title":"arXiv preprint arXiv:2311.04897 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.789598Z"},"links":{"cited_paper":"/paper/2311.04897","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:3b1f08b0868faac6691906f8b4f9928f3abb14c75629cc77e0cb2c643ae9e802","observation_id":"f1ad7109-6e78-4e7b-b84a-d6460f5ca069","resolution":{"observed_at":"2026-08-14T04:16:16.789598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-08-15T06:49:05.272450Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-08-14T04:16:16.794208Z","title":"arXiv preprint arXiv:2403.05846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.794208Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:42f8e4a586698b2d3d400f3c27627a289895dbcf67749bb3a7c74e91864cf385","observation_id":"693ede22-eeb3-411d-9489-7fe5acd03426","resolution":{"observed_at":"2026-08-14T04:16:16.794208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.798758Z","title":"arXiv preprint arXiv:2502.16570 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.798758Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:cae11036f425d9e1e983d9654328c67bc294e139b5ac18ad5b5924ce03add047","observation_id":"0d554eb8-7612-4903-a904-a1dc6be7639d","resolution":{"observed_at":"2026-08-14T04:16:16.798758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.813063Z","title":"Joint International Conference on Computational Linguistics, Language Resources and Evaluation , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.813063Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:d5871ba457dcbc7245e9f52dc806db1b2ff97cf8b0be2af116aa3ee223b810ec","observation_id":"d955fe39-080a-4525-bd04-00ee4a0bad80","resolution":{"observed_at":"2026-08-14T04:16:16.813063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.835745Z","title":"59th Annual Meeting of the Association for Computational Linguistics and the 11th International Joint Conference on Natural Language Processing , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.835745Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:c2c997f18732367f089c0643d7d524ef9d2aae4b5c536fa5a3788b885b1f3007","observation_id":"39315078-046c-455d-adb4-ab76ac40381a","resolution":{"observed_at":"2026-08-14T04:16:16.835745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.860014Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.860014Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:e3b58f4eeedb0ce591f124b3f2df5cb4a971181458d4d837c1816d3187c88b80","observation_id":"a64b9ce2-fe16-44d6-9a56-908798de98b0","resolution":{"observed_at":"2026-08-14T04:16:16.860014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.864968Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.864968Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a62f541fca8bb0103499b758ff93dc8fe5c329ed25e435fe294c006741c9ef02","observation_id":"7bb2f87b-0f44-40dd-85c9-216dd92b338f","resolution":{"observed_at":"2026-08-14T04:16:16.864968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.869478Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.869478Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:251bdee929e5ed1bf6509167291214d411ff71d6b52547d949bc1bb76c5478d3","observation_id":"9d337b47-efb5-42e0-97f1-d42832593864","resolution":{"observed_at":"2026-08-14T04:16:16.869478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0907.3740","last_updated":"2009-07-21T20:21:38Z","snapshot_observed_at":"2026-08-15T05:43:10.523620Z","submitted_at":"2009-07-21T20:21:38Z","title":"Empirical Bernstein Bounds and Sample Variance Penalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0907.3740","snapshot_observed_at":"2026-08-14T04:16:16.873924Z","title":"Empirical","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.873924Z"},"links":{"cited_paper":"/paper/0907.3740","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a5892a7f84054c26b1a1a5d7f4d062747bbd1c85ab65f1b07d0a0fb91449fff6","observation_id":"25954fe2-249a-4291-ac7f-5698a507ad82","resolution":{"observed_at":"2026-08-14T04:16:16.873924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.01060","last_updated":"2020-11-12T07:47:48Z","snapshot_observed_at":"2026-08-14T05:50:17.249446Z","submitted_at":"2020-11-02T15:42:40Z","title":"Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.01060","snapshot_observed_at":"2026-08-14T04:16:16.879794Z","title":"Constructing A Multi-hop","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.879794Z"},"links":{"cited_paper":"/paper/2011.01060","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:24d1d6fe240fe9824de2c12766c8f8b5f6b42ea3aecabbbf51f1269e11932bc4","observation_id":"bf81d290-3523-4c20-b077-1c4ee61a10b0","resolution":{"observed_at":"2026-08-14T04:16:16.879794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.884337Z","title":"2020 , howpublished =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.884337Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:640ff60df0fc8629799c39cdbe4e185217de2fa78defee6488bdc6b721f8e2c1","observation_id":"4c9e03c5-a99a-4e30-b69f-a6936db63c03","resolution":{"observed_at":"2026-08-14T04:16:16.884337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.889458Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.889458Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:92c41cb2b263d99b026bf668deecee903b8f338acff47389552f68107473f696","observation_id":"874cfa9a-f9fe-4640-83c3-84afea313625","resolution":{"observed_at":"2026-08-14T04:16:16.889458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.895226Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.895226Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:ee14e75a5d1e375539a172f32f0ceefb6c0b3c32b836578fb61f4071afe2fdb4","observation_id":"37620d81-14f6-4950-ba03-a0fbea668137","resolution":{"observed_at":"2026-08-14T04:16:16.895226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.903671Z","title":"Better Estimation of the","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.903671Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:861baa64dc02fe7bccd27f379306f82a52fffb83841be5a8d96bf3c025136b8b","observation_id":"94c943a3-7f3f-46e2-88cf-d5bdf51abe1d","resolution":{"observed_at":"2026-08-14T04:16:16.903671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.910530Z","title":"A Comedy of Estimators: On","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.910530Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:94cfe2735513436d8174a20efae0b0618a447db70bd5201c37a24722ac29f545","observation_id":"390f99e4-8ce7-4e50-a47d-05c18ea6f590","resolution":{"observed_at":"2026-08-14T04:16:16.910530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.923687Z","title":"arXiv preprint arXiv:2408.01416 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.923687Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:0601e4d24340926c8e66c7b02a593d8b40971dcfcfe607c49620a5ca94039b71","observation_id":"7bf221e7-a34b-41db-8152-55fb22fe6a35","resolution":{"observed_at":"2026-08-14T04:16:16.923687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.936844Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.936844Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:db573849a4e3e35cacf4f982d174df3bf0ed3934adc0e2922c4bf4a4a08704b5","observation_id":"1f924db0-8279-4e39-91e9-b0d5d8e6e0f5","resolution":{"observed_at":"2026-08-14T04:16:16.936844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.942402Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.942402Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a16e4a8633eb3cb575c0359ed19b053ccd68ecb3e629e8ca952bd4239a4e49cd","observation_id":"957cd34f-f486-4176-9176-7a9f0e4bff51","resolution":{"observed_at":"2026-08-14T04:16:16.942402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.946497Z","title":"Feature Visualization , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.946497Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:d5bbd579dc65d00833fad82d5b8158d9abac500095132467e8b6c312f6a171c6","observation_id":"8317f3b9-6f90-4ad0-9374-cbd2d6dd9d55","resolution":{"observed_at":"2026-08-14T04:16:16.946497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.950537Z","title":"Distill , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.950537Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:571cf32350a706f3d2fd0f8facf0650323e2fd550f2f799af03d51895d96d948","observation_id":"abea76c9-a3ca-41ce-bb31-4564e8eba643","resolution":{"observed_at":"2026-08-14T04:16:16.950537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.954148Z","title":"What Does BERT Look at? A n Analysis of BERT ' s Attention","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.954148Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:874660c60b144f0a06dcad1172b961778290c0b49d43f85ea9de2a813e1283f1","observation_id":"65c62c95-fd73-4a6a-bc3f-e80a4cddd657","resolution":{"observed_at":"2026-08-14T04:16:16.954148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.959921Z","title":"Analyzing Multi-Head Self-Attention: Specialized Heads Do the Heavy Lifting, the Rest Can Be Pruned","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.959921Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:dda65dc5af7f8edccd03c248a67d33d8bd8bad0c2da84bae2714c55c6f881909","observation_id":"dd457df7-085e-4ee7-bb2b-4853866afda5","resolution":{"observed_at":"2026-08-14T04:16:16.959921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.964424Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.964424Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:097e877e869306b26ebeac06234f23fb1522fba23ccb544fde4697ac255f6812","observation_id":"178080f5-c8c6-4667-ad23-c46d6da9e96e","resolution":{"observed_at":"2026-08-14T04:16:16.964424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.970596Z","title":"36th International Conference on Neural Information Processing Systems , articleno =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.970596Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8a3729c76f439b807d3b578c7bd6f33dcab3912843c7752feed9ce9579ac7690","observation_id":"122c2c2c-44b6-43dc-9947-91cbd240b842","resolution":{"observed_at":"2026-08-14T04:16:16.970596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.977977Z","title":"What do Neural Machine Translation Models Learn about Morphology?","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.977977Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:52a711275027f5c7f6a32a815a7ddd6d434c70161fe92502afa6c5efec5a60f9","observation_id":"2b5fa53e-3635-4a23-b78b-9694c0337832","resolution":{"observed_at":"2026-08-14T04:16:16.977977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.982795Z","title":"A Structural Probe for Finding Syntax in Word Representations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.982795Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:1d5164da3c0c584471dd680a668748c85e5d67eb7fef271f5133bb607a674473","observation_id":"8ec2b9ff-7672-4566-b89a-3d68d3788da1","resolution":{"observed_at":"2026-08-14T04:16:16.982795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.987616Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.987616Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:cb2ddc620fa008f79f7b45bbcfb9882fca7932849c320771694414c2a2830a02","observation_id":"b9e36f81-3f05-4363-870b-77f5cc2bf798","resolution":{"observed_at":"2026-08-14T04:16:16.987616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:16.994025Z","title":"Emergent Linear Representations in World Models of Self-Supervised Sequence Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:16.994025Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:8b279ef27f341e15411513c1cb228efbe78149e6fba587fe7a3063e4c159ec1e","observation_id":"8de10617-827c-4163-a21e-f2bfe582ca91","resolution":{"observed_at":"2026-08-14T04:16:16.994025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.004172Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.004172Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:ffb1f7d016257be660df063058ff335d0e153d15c784dc747c73aa53192f60b7","observation_id":"cf528e9f-7ca8-43e0-875d-110c378369a2","resolution":{"observed_at":"2026-08-14T04:16:17.004172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.010863Z","title":"Daniel and Sumers, Theodore R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.010863Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:165039c711799226cb85d6612c995ba100dd8aa991826d93558e059bb1e53a3b","observation_id":"eaa88cc8-801a-401f-9b37-291f8059e56c","resolution":{"observed_at":"2026-08-14T04:16:17.010863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.017203Z","title":"AI Alignment Forum , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.017203Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:80de136467b5be94439a8ee80009390d488d988cfaad4b0ad413ae28c1cb96c6","observation_id":"eb2cce3f-e41d-48c9-8b00-857cd854d529","resolution":{"observed_at":"2026-08-14T04:16:17.017203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.021670Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.021670Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:cdd8bf526f1d9b57ccc544d4f9b3ec68ccb7284a414c8fc2911bd1b6c77d312f","observation_id":"905707db-39e2-4fbc-ad75-6c5ad0395969","resolution":{"observed_at":"2026-08-14T04:16:17.021670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.ins.2023.03.050","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.417373Z","title":"Adaptive learning rate optimization algorithms with dynamic bound based on","venue":null,"work_id":"f3c9ad68-d89b-4a5d-bafc-84568b89f0ef","year":2023},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.026233Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:204f1514b02978a7f4416c69a70af2a7d105fc962a6fc2d76fce757602bfcd81","observation_id":"21a98f45-54f5-48a1-95c5-a4a7847fc1ce","resolution":{"observed_at":"2026-08-14T04:16:17.425195Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.033006Z","title":"2015 , eprint=","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.033006Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:41c8b66b9fc639dc159383df01eebde50f0282ef0a48a1db16c15632abbb62d5","observation_id":"49574f5d-3997-45b9-bb2f-1ff910a7ac4c","resolution":{"observed_at":"2026-08-14T04:16:17.033006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-14T04:16:17.037782Z","title":null,"venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.037782Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:81e7444f838ce994489657aaa687d2ddf9d526053c05b34e63e50ea950131f36","observation_id":"d75d977b-e07f-47ca-9620-450a8042d106","resolution":{"observed_at":"2026-08-14T04:16:17.037782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.042510Z","title":"2019 , eprint=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.042510Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:fec0079b1eeb8217df13fa5d9157327c87f1be941e802e155cb8e45c2d74ee3c","observation_id":"acb6d2ef-6822-455c-a41a-40a687f1013f","resolution":{"observed_at":"2026-08-14T04:16:17.042510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.046462Z","title":"35th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.046462Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:256c9cd3516b33b7389f7d919e06f20e66a358e5c40260ff9e48de5f4f2f6b12","observation_id":"9c5dd915-5ba9-4602-adaa-a368aa0a2752","resolution":{"observed_at":"2026-08-14T04:16:17.046462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.051457Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.051457Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:30d05d15cfec06382a8b64b7f3bc93afe1c0e1bf56d41549cae140fbdb0c8ff0","observation_id":"cc58e91f-06d9-49c5-87ae-01e326a0f80e","resolution":{"observed_at":"2026-08-14T04:16:17.051457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.055071Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.055071Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:4540d3873484527a81980e0ab5a9e2554b5a93274f64503d567e7a669fc7b237","observation_id":"76a5008c-89b6-48d7-9e75-fe000d6cebb2","resolution":{"observed_at":"2026-08-14T04:16:17.055071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.058965Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.058965Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:6ed24a0199ea17d5da530400a31d815d19c10f40a54afa36fe4c545df5b65b12","observation_id":"4eec9b34-799d-4208-a154-ec70bad00d99","resolution":{"observed_at":"2026-08-14T04:16:17.058965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.063177Z","title":"International Conference for High Performance Computing, Networking, Storage and Analysis , articleno =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.063177Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:e7485efcc1ff263ec907bd6d86dc673e27ecdcdf297a1d81500dbe8e6e7d2f68","observation_id":"28bbd611-188b-490f-a6df-3c38379dac2f","resolution":{"observed_at":"2026-08-14T04:16:17.063177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06840","last_updated":"2021-01-18T02:11:25Z","snapshot_observed_at":"2026-07-06T10:33:17.427927Z","submitted_at":"2021-01-18T02:11:25Z","title":"ZeRO-Offload: Democratizing Billion-Scale Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06840","snapshot_observed_at":"2026-08-14T04:16:17.067120Z","title":"2101.06840 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.067120Z"},"links":{"cited_paper":"/paper/2101.06840","citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:a390a76941ce25b98739b39c3500a2a4507222529e959759a970ee6abee277d7","observation_id":"e7e33618-595a-4f2c-8e6d-b48460f01c7a","resolution":{"observed_at":"2026-08-14T04:16:17.067120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.071305Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.071305Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:be9c35051a004c737c093bf9854ac7322074456fcf66eb4f8da3064f20db6188","observation_id":"dcaad60d-8680-44a8-a783-2d8e31635c4e","resolution":{"observed_at":"2026-08-14T04:16:17.071305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:16:17.075444Z","title":"Building Production-Ready Probes For","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-14T04:16:17.075444Z"},"links":{"citing_paper":"/paper/2608.10260"},"observation_digest":"sha256:7fb8365735c7ee7d19847ccfd3f2d4b22d78cdcc1b2033b36f95c5112cad1470","observation_id":"e3e1787c-4204-476c-acbf-c575d64b83de","resolution":{"observed_at":"2026-08-14T04:16:17.075444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.10260","last_updated":"2026-08-10T21:49:45Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T23:10:23.372696Z","submitted_at":"2026-08-10T21:49:45Z","title":"Interpreting Language Model Hidden States at Scale"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":151},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 151 outbound references and 0 inbound Pith citation observations for arXiv:2608.10260."}