{"as_of":"2026-08-08T04:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02ce3c25bf996ed4d0e81d1bba3b626363b7d804320e3ed97f2f404cfcc6ca7e","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:07:12.195614Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:17:13.117220Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:16:47.723815Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2604.06377","last_updated":"2026-05-05T18:37:43Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T19:02:10Z","title":"The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:44.401045Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2604.06377"},"observation_digest":"sha256:eb277f4b40225fbc441fe1703e49e20399ffb57fd41a6c915ea35791b9405ab9","observation_id":"0fc98fd8-5782-41cf-a7c4-f2945f1edad8","resolution":{"observed_at":"2026-05-11T00:15:56.149206Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2605.08254","last_updated":"2026-05-07T19:38:12Z","snapshot_observed_at":"2026-07-06T23:20:28.875586Z","submitted_at":"2026-05-07T19:38:12Z","title":"HyperTransport: Amortized Conditioning of T2I Generative Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T01:56:34.395472Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2605.08254"},"observation_digest":"sha256:e378c1acdf68d1e0f3559e6eabe618bf0c5712b7af33e3a137eddbc54dcc44d1","observation_id":"4162988a-02e1-4a80-8dd0-8f0f308515bf","resolution":{"observed_at":"2026-05-12T07:46:38.048741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":"2506.00653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-07-02T08:16:47.723815Z","title":"Bello, A","venue":null,"work_id":"f3a0c2cd-a15d-41c2-a12a-3969d7662c54","year":2025},"citing_paper":{"arxiv_id":"2606.05290","last_updated":"2026-06-03T18:00:04Z","snapshot_observed_at":"2026-07-06T23:45:19.055840Z","submitted_at":"2026-06-03T18:00:04Z","title":"Do Models Share Safety Representations? Cross-Model Steering for Safe Visual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T06:16:53.305354Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2606.05290"},"observation_digest":"sha256:93b5967bd8738bae71997a43bcfc2250efab01cbe4fa5f616a4be6e445559064","observation_id":"c513d267-dd03-40cc-ba38-b2d9c5ca2870","resolution":{"observed_at":"2026-07-02T08:16:47.725232Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00653","snapshot_observed_at":"2026-08-05T10:17:13.117220Z","title":"Linear representation transferability hypothesis: Leveraging small models to steer large models.arXiv preprint arXiv:2506.00653,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03893","last_updated":"2026-08-04T16:26:47Z","snapshot_observed_at":"2026-08-07T23:12:37.781992Z","submitted_at":"2026-08-04T16:26:47Z","title":"Cross-Model KV Cache Transfer in LLM Families: A Closed-Form Linear Mapping for Prefill Reuse","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:13.117220Z"},"links":{"cited_paper":"/paper/2506.00653","citing_paper":"/paper/2608.03893"},"observation_digest":"sha256:eaa09642827eed484d6ba9c798f001eff07df214e4347af17932bd18f013a4b9","observation_id":"04dfa064-c0a2-43b8-9fc6-10db9eb3cc33","resolution":{"observed_at":"2026-08-05T10:17:13.117220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00653/citation-record","integrity":"/paper/2506.00653/integrity","json":"/paper/2506.00653/citation-record.json","paper":"/paper/2506.00653"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-08-07T12:07:09.147565Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.147565Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:e478cca481e6573ea2d8f1bd6e0bd66407058336cd4f5776c7d4aa7f4619da0b","observation_id":"71a66a4d-1d65-4ef3-8742-eaab81d6aca7","resolution":{"observed_at":"2026-08-07T12:07:09.147565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:16.019624Z","title":"Revisiting model stitching to compare neural representations","venue":null,"work_id":"87b4599a-301c-44cb-8686-ffd4406e88f4","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.220366Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:aae92addd235af306e1059368842301371ad279b70058bccd858a28104cbb541","observation_id":"1853f68c-b9e1-447d-b13f-92231db45124","resolution":{"observed_at":"2026-08-07T12:07:16.061940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12030","last_updated":"2025-01-27T10:02:44Z","snapshot_observed_at":"2026-07-06T17:32:06.610773Z","submitted_at":"2024-02-19T10:37:29Z","title":"Towards Cross-Tokenizer Distillation: the Universal Logit Distillation Loss for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12030","snapshot_observed_at":"2026-08-07T12:07:09.286384Z","title":"Towards cross-tokenizer distillation: the universal logit distillation loss for llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.286384Z"},"links":{"cited_paper":"/paper/2402.12030","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:926d5886db339e2500522e5be10fa0d3a69527ed1a31d34e980082b090271ae0","observation_id":"4e11166d-3e79-44f6-b5b2-65be13bc0482","resolution":{"observed_at":"2026-08-07T12:07:09.286384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:09.386595Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.386595Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:128818b9ae39bb23d13b2f59bc1996d26406046e54ed26d7b88411efa99f030d","observation_id":"068618f1-6652-41dc-9e8b-c4d05f3b8642","resolution":{"observed_at":"2026-08-07T12:07:09.386595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.871240Z","title":"Curve circuits","venue":null,"work_id":"127ea512-3e91-4e47-8a88-24ef77997602","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.482358Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5b9744aa65bad08027e8f1a7f8749c0fe91f1d9d1f65acca749cadce7156f3cf","observation_id":"23488e73-c4a0-4368-bb38-b4274ce3b555","resolution":{"observed_at":"2026-08-07T12:07:15.910916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.711912Z","title":"Similarity and matching of neural network representations","venue":null,"work_id":"d3238007-99b7-4255-837e-dd4ca1f77bec","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.568445Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:41bffb112b3a9bce5eef38484066501ece7728985bd4c9a56d660d84442ebff5","observation_id":"fdd7fd8f-625c-44fe-a744-18425836d52b","resolution":{"observed_at":"2026-08-07T12:07:15.758563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:09.661210Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.661210Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:7fc36dca76614d6cc97a980a0c11688615ecb557c81f0932e1b7231690c43cdd","observation_id":"54bd986e-1009-46cc-a431-39829c0c8e44","resolution":{"observed_at":"2026-08-07T12:07:09.661210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.547656Z","title":"Toy models of superposition","venue":null,"work_id":"5f36432c-c4dd-4024-90c8-36a47058255e","year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.753535Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:c64f24d100b478070830e16a18308a4cb7fbd35b85f22de8082b04d41cee31a2","observation_id":"542c91c9-630b-4f7f-8dc1-3b870637948d","resolution":{"observed_at":"2026-08-07T12:07:15.599874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T12:07:09.798719Z","title":"The P ile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.798719Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:f170c0668a2e9695fda8cdff98e6a8a7d814395a509cbe5a52b89245ce33bcba","observation_id":"181f0547-4cf8-4b1f-828b-6b90458c181d","resolution":{"observed_at":"2026-08-07T12:07:09.798719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.359025Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":"d022d63d-7c65-4c56-81e1-dd1848fbf6b8","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.907199Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:f6deaeddc8e675d6bff1ceed1d1ef0e7f1f4b507de569371d8a354c8241fc2d9","observation_id":"a889b737-5291-43d4-b07a-806665e48ffb","resolution":{"observed_at":"2026-08-07T12:07:15.444373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:15.176158Z","title":"Saes are highly dataset dependent: A case study on the refusal direction","venue":null,"work_id":"f0ac5850-bba1-4fc7-8afe-a48f6b9d9e7b","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:09.968105Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:168d5868fc913f3f84de897767579c3375727b01b82a3147b0115dad3a019a98","observation_id":"d6e9f57c-9577-4bfe-b046-bb0c33310f70","resolution":{"observed_at":"2026-08-07T12:07:15.255568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02730","last_updated":"2023-12-05T12:48:04Z","snapshot_observed_at":"2026-07-06T16:57:09.664139Z","submitted_at":"2023-12-05T12:48:04Z","title":"Towards Measuring Representational Similarity of Large Language Models","version":1},"cited_work":{"arxiv_id":"2312.02730","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.02730","snapshot_observed_at":"2026-08-07T12:07:13.386978Z","title":"Towards Measuring Representational Similarity of Large Language Models","venue":"cs.LG","work_id":"ed6d72a0-d347-4e70-8035-e0267c460eaf","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.018944Z"},"links":{"cited_paper":"/paper/2312.02730","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5e0e2490c73fbb3a11e756ca5331e2dcfb65d8037e20d7f82c820b2933c48a81","observation_id":"ad37495f-aa31-4b3c-b907-660b392b9047","resolution":{"observed_at":"2026-08-07T12:07:13.440934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.990400Z","title":"Similarity of neural network models: A survey of functional and representational measures","venue":null,"work_id":"f43855b2-ebd6-4e86-b125-1cb5ee6db664","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.104251Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:d65cc1210252323a7b1e54c1fd41d7da727fc4266af2a34e89c93738ad0bf3b0","observation_id":"30372933-9dce-4e6e-a68f-9fec3583b8aa","resolution":{"observed_at":"2026-08-07T12:07:15.115350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00531","last_updated":"2025-03-11T20:01:30Z","snapshot_observed_at":"2026-07-06T18:55:32.910650Z","submitted_at":"2024-08-01T13:08:02Z","title":"ReSi: A Comprehensive Benchmark for Representational Similarity Measures","version":2},"cited_work":{"arxiv_id":"2408.00531","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00531","snapshot_observed_at":"2026-08-07T12:07:13.212115Z","title":"ReSi: A Comprehensive Benchmark for Representational Similarity Measures","venue":"cs.LG","work_id":"bde77515-a04f-4098-8d8e-34c7296bf595","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.191437Z"},"links":{"cited_paper":"/paper/2408.00531","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:dc1c3c8d78e9a85752d62d93aff10d8beb12c99b1572ae52cd98e40270d0b694","observation_id":"78737e0f-a994-4e71-b8c7-4da7f55010ad","resolution":{"observed_at":"2026-08-07T12:07:13.279213Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.00414","last_updated":"2019-07-19T14:59:45Z","snapshot_observed_at":"2026-07-06T07:49:47.294073Z","submitted_at":"2019-05-01T17:57:26Z","title":"Similarity of Neural Network Representations Revisited","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.00414","snapshot_observed_at":"2026-08-07T12:07:10.243871Z","title":null,"venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.243871Z"},"links":{"cited_paper":"/paper/1905.00414","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:8876275df54561c4f06bc0d0196bada72c9bf5cff0846a0e82721eeb2785ea51","observation_id":"3dca8ab0-46ef-4f01-a261-4dfd211b2333","resolution":{"observed_at":"2026-08-07T12:07:10.243871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19384","last_updated":"2025-06-16T10:21:00Z","snapshot_observed_at":"2026-07-06T18:38:05.229292Z","submitted_at":"2024-06-27T17:57:03Z","title":"The Remarkable Robustness of LLMs: Stages of Inference?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19384","snapshot_observed_at":"2026-08-07T12:07:10.354834Z","title":"The remarkable robustness of llms: Stages of inference? arXiv preprint arXiv:2406.19384, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.354834Z"},"links":{"cited_paper":"/paper/2406.19384","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a3ab228e352428e5f26bffb005764ff1e55b5a2b506db042c50efb6abcba2d64","observation_id":"812f38d5-6cd1-4929-875a-da40cf98fb9d","resolution":{"observed_at":"2026-08-07T12:07:10.354834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06981","last_updated":"2025-05-21T00:01:46Z","snapshot_observed_at":"2026-08-07T14:16:41.337428Z","submitted_at":"2024-10-09T15:18:57Z","title":"Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06981","snapshot_observed_at":"2026-08-07T12:07:10.417992Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.417992Z"},"links":{"cited_paper":"/paper/2410.06981","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:acaee1c37a26d7e0603016f9d3b1c23254c0e4d2a01a41a35b832f16b4983e7f","observation_id":"5976de11-95bb-44e3-859e-f70e38f5db6c","resolution":{"observed_at":"2026-08-07T12:07:10.417992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-07T12:07:10.502533Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.502533Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:b045234f7e82f1c1934c5b984e680b6f7d6d2896e551996167fc889921eb9140","observation_id":"804b3db4-8e99-435d-a6c0-0ffb280dc208","resolution":{"observed_at":"2026-08-07T12:07:10.502533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.826884Z","title":"URL https://transformer-circuits.pub/2024/crosscoders/index.html","venue":null,"work_id":"34a3ed30-006c-4211-80ce-84ee3be7495a","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.585162Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a52afaa38ddbfc4873486854e639d2745c63b673d91b68c709d84431e5583bd6","observation_id":"7d2338b6-bcfe-475d-9da8-5810a2ba536f","resolution":{"observed_at":"2026-08-07T12:07:14.902151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T12:07:10.667466Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.667466Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:e10f3a41c694f64fbd4727752ac915808c3bea6a2190eb0077ff439bde4bae5b","observation_id":"4a9a8fef-6870-4662-95a8-d5bcde2bd181","resolution":{"observed_at":"2026-08-07T12:07:10.667466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15162","last_updated":"2023-03-09T15:02:07Z","snapshot_observed_at":"2026-08-07T15:16:29.262048Z","submitted_at":"2022-09-30T01:17:18Z","title":"Linearly Mapping from Image to Text Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15162","snapshot_observed_at":"2026-08-07T12:07:10.760990Z","title":"Linearly mapping from image to text space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.760990Z"},"links":{"cited_paper":"/paper/2209.15162","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:26f2de43877b4f30506dcb4a90b85ea43c689dff3d8ae671bafd6fb60e00e249","observation_id":"ed5e59d7-52f9-433a-b7ff-b5ed70cd1a96","resolution":{"observed_at":"2026-08-07T12:07:10.760990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:10.807782Z","title":"Cross-tokenizer distillation via approximate likelihood matching","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.807782Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:8e63ab928508cdefa68a557400bd2a9e956b63272ecda971a77937ed4cdf46d4","observation_id":"27ff1048-9e8f-4700-9b80-446a185067cf","resolution":{"observed_at":"2026-08-07T12:07:10.807782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.636301Z","title":"Neuronpedia, 2025","venue":null,"work_id":"d03d655d-82c5-469e-b457-5bf29f91e1e9","year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.908705Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5d6c0d04f603d77a0b1da822760027723a245a1b28aacfb9c936d76732b73623","observation_id":"4ab05bc6-bfe5-4cfd-bc63-ae374bf2e0f2","resolution":{"observed_at":"2026-08-07T12:07:14.719020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:10.953188Z","title":"Activation space interventions can be transferred between large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:10.953188Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:46ed53e669f6a49b44c123d45bd889fe5122665b58bda5ccd54832c1be7b3e80","observation_id":"731a14c1-d67b-46ff-be42-d98e11d29951","resolution":{"observed_at":"2026-08-07T12:07:10.953188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T12:07:11.081727Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.081727Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:8a3212a84bfadad4bfe368fa74189b4997f13c230c9b3f0b4b75188bf81bd0d5","observation_id":"243b6ac9-53e5-4a7a-92ee-4615b3a3f462","resolution":{"observed_at":"2026-08-07T12:07:11.081727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-07T12:07:11.137675Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.137675Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:6dd9a00a8ff7ba3faf5344ee056ca0af83578038ba9f9802f03c85f031c80419","observation_id":"f0e4ff69-eb6b-45ca-8c01-3f0ae753a251","resolution":{"observed_at":"2026-08-07T12:07:11.137675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.444388Z","title":"Svcca: Singular vector canonical correlation analysis for deep learning dynamics and interpretability","venue":null,"work_id":"65b3ec27-5f72-4379-af38-7fcf5eb87b4b","year":2017},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.276428Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:5bb8dd9f410c3a9e849457bdb3448ca6ed3090d524e21747e2da229be5633b82","observation_id":"5e965a90-148b-4552-a43c-0fb40882799b","resolution":{"observed_at":"2026-08-07T12:07:14.562404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.317050Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":"b1e1ef53-71c1-4cc8-9eec-981b11816851","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.331013Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:cb2735757738d57d166803e635c1b4a1dc694b3364627b31afed6bc57589ad7a","observation_id":"6277cc14-4c32-40b8-8d28-c0c1025b0305","resolution":{"observed_at":"2026-08-07T12:07:14.371582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.157174Z","title":"High-low frequency detectors","venue":null,"work_id":"4e8665b9-e88b-4a88-b156-80c4bb03a903","year":2021},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.420529Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:9028050154acedc62d17e66a3f0ada369a9d5135fc31aff126c8c47e1ff81c60","observation_id":"bac696bb-bc2b-4a50-bb1d-756bd26114c8","resolution":{"observed_at":"2026-08-07T12:07:14.201282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12877","last_updated":"2025-04-14T09:04:45Z","snapshot_observed_at":"2026-07-06T19:34:51.296918Z","submitted_at":"2024-10-15T08:38:20Z","title":"Improving Instruction-Following in Language Models through Activation Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12877","snapshot_observed_at":"2026-08-07T12:07:11.509790Z","title":"Improving instruction-following in language models through activation steering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.509790Z"},"links":{"cited_paper":"/paper/2410.12877","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:6b1d6a7f10569eab523a571ff859a8b0f55e6a3a4a49341424a239d0d0818983","observation_id":"bf416959-719e-4dd2-8b26-d21fcb152e1c","resolution":{"observed_at":"2026-08-07T12:07:11.509790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:14.033148Z","title":"Analysing the generalisation and reliability of steering vectors","venue":null,"work_id":"f3e7b1bc-7b5c-444d-b442-88c4ba99c68e","year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.544069Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:2101be4077786f458aa34b5c0bf02b204603700086d1323759a16d21c2b0d02c","observation_id":"092ae948-46ad-449a-85c3-f1f98c2b5b38","resolution":{"observed_at":"2026-08-07T12:07:14.088723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:11.660484Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.660484Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:9e7ac202d0e76b8295b627016e08378c9429772eb3f7d36ad2f5f8afc8d79563","observation_id":"dfcabeb0-d753-4d5a-9560-76b03b72702f","resolution":{"observed_at":"2026-08-07T12:07:11.660484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-07T12:07:11.742179Z","title":"Steering language models with activation engineering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.742179Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:23c651cfba45494ceeb75a52e115155797050cfdc56f6ed70b71c0566175b3e6","observation_id":"3dd77334-8c0e-4bd9-8186-cddb362d7f7c","resolution":{"observed_at":"2026-08-07T12:07:11.742179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10491","last_updated":"2024-01-22T17:16:37Z","snapshot_observed_at":"2026-08-04T23:37:08.155969Z","submitted_at":"2024-01-19T05:02:46Z","title":"Knowledge Fusion of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10491","snapshot_observed_at":"2026-08-07T12:07:11.805248Z","title":"Knowledge fusion of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.805248Z"},"links":{"cited_paper":"/paper/2401.10491","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:e3554e4883bb8980972db9138c73310b201f509ba40a8d755520c5b422b10fd4","observation_id":"d09cd282-1a87-4730-8dfb-114bb3378dab","resolution":{"observed_at":"2026-08-07T12:07:11.805248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:13.828326Z","title":"Hopcroft","venue":null,"work_id":"21556733-6cc3-4262-b599-156fd34c135c","year":2018},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.894618Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:1001202e0edab0292ff73aa34570d948cabbe2967d9c6ceadd5b1880472ffc46","observation_id":"9264869d-b344-4858-9f8f-8a172d8fd44b","resolution":{"observed_at":"2026-08-07T12:07:13.916585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-07T21:53:39.823463Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T12:07:11.939328Z","title":"Axbench: Steering llms? even simple baselines outperform sparse autoencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.939328Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:7cbc50ea0016bb983348aaee32d19b98df0875ff695214f0c7dbb9158c559d3b","observation_id":"a44a648d-3daf-4ca6-80dc-25d7bcf6f345","resolution":{"observed_at":"2026-08-07T12:07:11.939328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17409","last_updated":"2022-11-02T16:16:28Z","snapshot_observed_at":"2026-08-03T15:28:27.871509Z","submitted_at":"2022-10-24T10:16:13Z","title":"Deep Model Reassembly","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17409","snapshot_observed_at":"2026-08-07T12:07:11.998231Z","title":"Deep model reassembly","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:11.998231Z"},"links":{"cited_paper":"/paper/2210.17409","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:0da676bbe1ed01d6f243c7317b13a5a1ac9b71c31b9d871a467e090b68cac44c","observation_id":"5dbf071c-3e88-4dcc-9fa6-e6ef100916d9","resolution":{"observed_at":"2026-08-07T12:07:11.998231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:12.071091Z","title":"P Xing, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.071091Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:ca9b647326ebe8e920ff2769c2f7f1fd089049a5002b6c46cc652e6928fccb6b","observation_id":"61d6c3d7-4da1-4053-bda2-f7419232eed3","resolution":{"observed_at":"2026-08-07T12:07:12.071091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T12:07:12.114429Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.114429Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:a861c4976e56a40e8f196030db63d6924126a55ff2855f06a6d1b2930d00b4b0","observation_id":"308d5208-37dc-4c4b-bcac-2b83e1a16e8b","resolution":{"observed_at":"2026-08-07T12:07:12.114429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:07:13.613205Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":"22731d2c-ff1e-4f90-824b-bbb82b4d9382","year":2023},"citing_paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:12.195614Z"},"links":{"citing_paper":"/paper/2506.00653"},"observation_digest":"sha256:e955193cc380d8f5b38f594bfa051d6304c745ae2e628f4bcd8de2f3a0ad4f6c","observation_id":"4d05920c-ae7d-4d9a-b25a-1477954613bd","resolution":{"observed_at":"2026-08-07T12:07:13.691534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00653","last_updated":"2025-06-04T19:24:26Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T21:56:54.609521Z","submitted_at":"2025-05-31T17:45:18Z","title":"Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 4 inbound Pith citation observations for arXiv:2506.00653."}