{"as_of":"2026-08-08T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6756bd70242d9393e6551317c6ddd954e5cd52f8a617faa68ecd7b89d07d122c","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:51:34.287635Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T13:56:50.448698Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2601.21257","last_updated":"2026-04-19T21:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T04:36:52Z","title":"MoCo: A One-Stop Shop for Model Collaboration Research","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:37.129753Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2601.21257"},"observation_digest":"sha256:4593922001eecb207e800e3ebf3ca4f301462f828fb30aa68f3d89256f16a215","observation_id":"bd45fd71-d66b-4ecb-8bea-ce11dc8a86a5","resolution":{"observed_at":"2026-05-16T10:17:43.684248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2605.06225","last_updated":"2026-05-09T16:46:54Z","snapshot_observed_at":"2026-08-01T14:54:15.536868Z","submitted_at":"2026-05-07T13:19:33Z","title":"Memory Inception: Latent-Space KV Cache Manipulation for Steering LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-08T13:28:41.166652Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2605.06225"},"observation_digest":"sha256:3cf83e5c803fa3eeaeb2a13fd1c6765e3328308663bf0663d1e61110cd0ae7c3","observation_id":"49a0fd29-985e-4544-b5dd-a715694b40c1","resolution":{"observed_at":"2026-05-08T21:29:13.695411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2605.06225","last_updated":"2026-05-09T16:46:54Z","snapshot_observed_at":"2026-08-01T14:54:15.536868Z","submitted_at":"2026-05-07T13:19:33Z","title":"Memory Inception: Latent-Space KV Cache Manipulation for Steering LLMs","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T01:58:30.870257Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2605.06225"},"observation_digest":"sha256:a7f6bddfe8251d928a866d4ffab6d38db9645795289e4bd6439480624460b135","observation_id":"410c25b1-25b5-43c9-893e-def92cb8585e","resolution":{"observed_at":"2026-05-12T02:01:14.507431Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2605.16362","last_updated":"2026-05-20T21:23:48Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-09T14:26:49Z","title":"When Is Rank-1 Steering Cheap? Geometry, Granularity, and Budgeted Search","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T22:36:12.466550Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2605.16362"},"observation_digest":"sha256:3e26063a7da6da59f03cd93e122477b6c58d9ae28ea969d998eedb7dcf8acae0","observation_id":"31377256-b0a5-4b47-8f5a-00aa14633ff3","resolution":{"observed_at":"2026-05-20T22:39:10.687035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2605.16362","last_updated":"2026-05-20T21:23:48Z","snapshot_observed_at":"2026-07-06T23:27:29.931962Z","submitted_at":"2026-05-09T14:26:49Z","title":"When Is Rank-1 Steering Cheap? Geometry, Granularity, and Budgeted Search","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T09:59:32.201925Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2605.16362"},"observation_digest":"sha256:9a9b264c98138ba7ab57911b0bb3aface40dd80a9ff62b59e7ca0dba615859f9","observation_id":"e941edfa-db16-490b-956b-2b7fe77ee277","resolution":{"observed_at":"2026-05-22T10:01:23.531409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":"2505.20809","doi":"10.48550/arxiv.2505.20809","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Manning, and Christopher Potts","venue":"ArXiv.org","work_id":"f13b8c95-91ea-44f8-ab68-3cc1ba07299f","year":2025},"citing_paper":{"arxiv_id":"2606.03093","last_updated":"2026-06-02T03:27:24Z","snapshot_observed_at":"2026-07-06T23:43:22.513369Z","submitted_at":"2026-06-02T03:27:24Z","title":"Decomposing how prompting steers behavior","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T10:39:58.885284Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2606.03093"},"observation_digest":"sha256:ccc84cbfd2dca1332c39a1cc3f7ef9e9f4a8b2b6bf7a4e769bb1531b0c7ea9b0","observation_id":"d364a528-70a2-4e3e-81ba-1f99e2c295e6","resolution":{"observed_at":"2026-07-02T02:46:28.562016Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20809","snapshot_observed_at":"2026-08-02T13:56:50.448698Z","title":"Improved representation steering for language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18259","last_updated":"2026-05-15T15:34:48Z","snapshot_observed_at":"2026-08-08T01:48:17.759173Z","submitted_at":"2026-05-15T15:34:48Z","title":"Probabilistic Concept-Aware Steering for Trustworthy LLM Inference","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-02T13:56:50.448698Z"},"links":{"cited_paper":"/paper/2505.20809","citing_paper":"/paper/2607.18259"},"observation_digest":"sha256:db4fc7463f97a2880cac1cd79fc95e8add503330bc94427ed881d107b97fab7c","observation_id":"12101ac5-445d-4b66-9e02-b331805b84b1","resolution":{"observed_at":"2026-08-02T13:56:50.448698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20809/citation-record","integrity":"/paper/2505.20809/integrity","json":"/paper/2505.20809/citation-record.json","paper":"/paper/2505.20809"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:37.607794Z","title":"Bowman, Ethan Perez, Roger Baker Grosse, and David Duvenaud","venue":null,"work_id":"c2224e76-75d2-497c-85ca-e1818e9d11e3","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:27.384141Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:7c2b44539cb80df23640b31732b8fcea1b2493b0ec5e9bfef4c287db7c81586b","observation_id":"5a62e5b2-3f4c-4ed2-83d2-7136cdc7792c","resolution":{"observed_at":"2026-08-07T13:51:37.757568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11355","last_updated":"2025-02-11T16:03:35Z","snapshot_observed_at":"2026-08-07T21:55:17.727887Z","submitted_at":"2024-02-17T18:12:02Z","title":"A Practical Method for Generating String Counterfactuals","version":5},"cited_work":{"arxiv_id":"2402.11355","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11355","snapshot_observed_at":"2026-08-07T13:51:35.127892Z","title":"A Practical Method for Generating String Counterfactuals","venue":"cs.CL","work_id":"b4485890-bb60-4f49-b9f2-53f5e25f6313","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:27.437677Z"},"links":{"cited_paper":"/paper/2402.11355","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c7a19e5debe1278a2a241f1e797b5832e4df84fda4725b69d89cbd8b749afd13","observation_id":"ae0f7ad4-cc3a-4472-b6eb-cd936ef804b7","resolution":{"observed_at":"2026-08-07T13:51:35.278390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:37.467629Z","title":"Comparing bad apples to good oranges: Aligning large language models via joint preference optimization","venue":null,"work_id":"e985fe79-9642-4fc8-894d-80c8bf114b4a","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:27.642028Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:f9abd55288baada1c45f54d6002e5b60dcf99a0b21ceaa12dfb484efca362d62","observation_id":"5f304770-0af0-47d7-9498-cf6f4cc37713","resolution":{"observed_at":"2026-08-07T13:51:37.509250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03819","last_updated":"2025-04-03T01:51:37Z","snapshot_observed_at":"2026-08-04T07:02:56.483682Z","submitted_at":"2023-06-06T16:07:24Z","title":"LEACE: Perfect linear concept erasure in closed form","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03819","snapshot_observed_at":"2026-08-07T13:51:27.766075Z","title":"LEACE : P erfect linear concept erasure in closed form","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:27.766075Z"},"links":{"cited_paper":"/paper/2306.03819","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:e6b4bc85456e1c24af53962bdafba3b9daf93f4d6ebf648eccd8262f71efab67","observation_id":"08b24cfc-1d9b-410a-b678-59098997a30a","resolution":{"observed_at":"2026-08-07T13:51:27.766075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:27.883129Z","title":"B it F it: Simple parameter-efficient fine-tuning for transformer-based masked language-models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:27.883129Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:0b1d9831befe19f72d23331ae23f525c8b50d94ab81943d996c2d70aaadb1272","observation_id":"aa41b212-c6e8-499a-a0e2-8567ba378498","resolution":{"observed_at":"2026-08-07T13:51:27.883129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00045","last_updated":"2024-07-29T18:19:35Z","snapshot_observed_at":"2026-08-07T01:32:56.141077Z","submitted_at":"2024-05-28T05:10:40Z","title":"Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00045","snapshot_observed_at":"2026-08-07T13:51:28.046485Z","title":"Personalized steering of large language models: Versatile steering vectors through bi-directional preference optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.046485Z"},"links":{"cited_paper":"/paper/2406.00045","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:711218ad365247d4279988e4afcafc4bfe5692de71234e0baa570d55cc1a481b","observation_id":"3116ee12-6fa9-46db-97a0-109b4eae495f","resolution":{"observed_at":"2026-08-07T13:51:28.046485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01077","last_updated":"2024-12-02T08:47:24Z","snapshot_observed_at":"2026-07-06T17:53:55.825572Z","submitted_at":"2024-04-01T12:19:08Z","title":"Efficient Prompting Methods for Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01077","snapshot_observed_at":"2026-08-07T13:51:28.142183Z","title":"Efficient prompting methods for large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.142183Z"},"links":{"cited_paper":"/paper/2404.01077","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:5b07f7292461ae8dda48acd8577d42c4fab02ed00e5dd3e08487d53716f07134","observation_id":"d7e33eb9-ae13-4d9e-abf5-7371e8ae0dae","resolution":{"observed_at":"2026-08-07T13:51:28.142183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T13:51:28.280501Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.280501Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:b84d68a34dbbe02eca5d0a76105e8ee51c7df529d6dc17e5d31a1c7a5a12aef2","observation_id":"4f091184-77ef-4f54-8d76-a2853f291c24","resolution":{"observed_at":"2026-08-07T13:51:28.280501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T13:51:28.402589Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.402589Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:8b16688cdf420b9c47af75ffdaee27fd78eca7cd79a5e6ebe7b7c43fae42122b","observation_id":"e0f24e44-91ec-494a-9a25-15c7effef494","resolution":{"observed_at":"2026-08-07T13:51:28.402589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:28.519278Z","title":"Free dolly: Introducing the world's first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.519278Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:628766f8facb0e71aca2cbf720a14d194d999d6b1b7fd1d5cc8e926dce7646a0","observation_id":"2a62a3b4-3bdb-40c1-971e-b053fb8f790f","resolution":{"observed_at":"2026-08-07T13:51:28.519278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:37.259686Z","title":null,"venue":null,"work_id":"c4af1454-f7cf-4fe4-8ac5-96914b837c31","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.659497Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:2aa81fe54ba7843821def4d9d9c6f5ff340998e0a2643aa294dae920132dc91b","observation_id":"be261199-e609-4d77-af44-e4806f4c0cb6","resolution":{"observed_at":"2026-08-07T13:51:37.356454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:37.110831Z","title":"L earn-to- S hare: A hardware-friendly transfer learning framework exploiting computation and parameter sharing","venue":null,"work_id":"b32f3812-d25c-4dff-8da3-058713e3ce2e","year":2021},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.755563Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:e9eb062b76bcfa34f55ce836cfa3a34c7d2c7bf5d5c18a57fdfe2e7e236b049e","observation_id":"062f9eed-bfd7-457b-86ee-ea9334d38ca6","resolution":{"observed_at":"2026-08-07T13:51:37.173648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T13:51:28.884418Z","title":"Gemma: Open models based on G emini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:28.884418Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:0dd1930ab4a70b534446b1efaf150e5a237e86e87518d78a005df26c3be7f45a","observation_id":"a2adedf3-f90a-4c42-9855-56f227417e75","resolution":{"observed_at":"2026-08-07T13:51:28.884418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14608","snapshot_observed_at":"2026-08-07T13:51:29.020741Z","title":"Parameter-efficient fine-tuning for large models: A comprehensive survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.020741Z"},"links":{"cited_paper":"/paper/2403.14608","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:26e6fb25d2b6efdd0c799f68258cd6dbde53d70b59f6e2048e8f71ee4e01fae7","observation_id":"0ebd9e5e-349c-445f-83dd-70af8610327e","resolution":{"observed_at":"2026-08-07T13:51:29.020741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.952699Z","title":"Understanding and minimising outlier features in Transformer training","venue":null,"work_id":"8efefb29-807c-4da1-943c-9833a0e75751","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.134208Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c6c82829822e5f956ea7f38a08ce5fe541303efaf97140efaa36354ffda3a007","observation_id":"81bd9f98-2cd7-48ce-9acb-a990c1f0c14b","resolution":{"observed_at":"2026-08-07T13:51:37.011547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04366","last_updated":"2022-02-02T16:39:23Z","snapshot_observed_at":"2026-08-08T06:15:11.222260Z","submitted_at":"2021-10-08T20:22:26Z","title":"Towards a Unified View of Parameter-Efficient Transfer Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04366","snapshot_observed_at":"2026-08-07T13:51:29.256225Z","title":"Towards a unified view of parameter-efficient transfer learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.256225Z"},"links":{"cited_paper":"/paper/2110.04366","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:0a4b64b5219e082fe13590a427445fcc73368ea65458b28ec6f1b16950529918","observation_id":"ab92520c-962e-4c29-bbe8-9f9fd5c55119","resolution":{"observed_at":"2026-08-07T13:51:29.256225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00751","last_updated":"2019-06-13T17:48:30Z","snapshot_observed_at":"2026-07-06T07:30:44.870185Z","submitted_at":"2019-02-02T16:29:47Z","title":"Parameter-Efficient Transfer Learning for NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00751","snapshot_observed_at":"2026-08-07T13:51:29.384491Z","title":"Parameter-efficient transfer learning for NLP","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.384491Z"},"links":{"cited_paper":"/paper/1902.00751","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:1e0922cb7c05c40d7d1d73dbfc49f6e35e7ddf0e5651b81e1b38e6a133e7b038","observation_id":"eca7f9a5-e849-4839-a3fc-e44e8026eaeb","resolution":{"observed_at":"2026-08-07T13:51:29.384491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:51:29.532182Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.532182Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c1ea56bf436cf62761dff216629a36d989458860948c93c6dca5c12d96b88ce2","observation_id":"85e92ba9-4ab6-45e8-8bdb-c9e45ba00af4","resolution":{"observed_at":"2026-08-07T13:51:29.532182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03714","last_updated":"2023-10-05T17:37:25Z","snapshot_observed_at":"2026-08-04T05:21:05.846165Z","submitted_at":"2023-10-05T17:37:25Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03714","snapshot_observed_at":"2026-08-07T13:51:29.671470Z","title":"Joshi, Hanna Moazam, Heather Miller, Matei Zaharia, and Christopher Potts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.671470Z"},"links":{"cited_paper":"/paper/2310.03714","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:cd2b57b85c4532717b482e8056564b490e8f0f2b8cedd6b7a78cb0766cdbbfa0","observation_id":"f0ba0c51-8c3f-4f9d-bd4a-bfa6152eec88","resolution":{"observed_at":"2026-08-07T13:51:29.671470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17741","last_updated":"2024-05-28T01:53:26Z","snapshot_observed_at":"2026-07-06T18:21:01.419111Z","submitted_at":"2024-05-28T01:53:26Z","title":"LoRA-Switch: Boosting the Efficiency of Dynamic LLM Adapters via System-Algorithm Co-design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17741","snapshot_observed_at":"2026-08-07T13:51:29.805453Z","title":"LoRA-Switch : Boosting the efficiency of dynamic llm adapters via system-algorithm co-design","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.805453Z"},"links":{"cited_paper":"/paper/2405.17741","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:3c5406bd467079c9b4aca15155603e6ad4ce297c930fdb81e06bf6d889956486","observation_id":"45102ba9-d29a-459b-83b1-7c772b173acf","resolution":{"observed_at":"2026-08-07T13:51:29.805453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T13:51:29.937614Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:29.937614Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:2057f94487a6ac8dd0b62f992b3d9dd366f29f749ce8f8ed1709d7701315084a","observation_id":"f7baa99e-6c27-4ad8-b091-8ce271582ea6","resolution":{"observed_at":"2026-08-07T13:51:29.937614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03341","last_updated":"2024-06-26T14:11:53Z","snapshot_observed_at":"2026-07-06T15:38:58.578200Z","submitted_at":"2023-06-06T01:26:53Z","title":"Inference-Time Intervention: Eliciting Truthful Answers from a Language Model","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03341","snapshot_observed_at":"2026-08-07T13:51:30.034450Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.034450Z"},"links":{"cited_paper":"/paper/2306.03341","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:0a5ab1044f767d014dad510e14af8d49e27d07062ffeeb7d33cceb4ebb83384c","observation_id":"a040b8e7-138b-476e-9f40-8cec9a003936","resolution":{"observed_at":"2026-08-07T13:51:30.034450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02446","last_updated":"2024-07-02T17:22:54Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:22:54Z","title":"Predicting vs. Acting: A Trade-off Between World Modeling & Agent Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02446","snapshot_observed_at":"2026-08-07T13:51:30.172115Z","title":"Predicting vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.172115Z"},"links":{"cited_paper":"/paper/2407.02446","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:af3ac1575600579e2c461c33305cf3c7666400b9a0621ba900b58e0dff8fd9ec","observation_id":"f4b82198-9b33-4cf1-a36f-bd9db8f48b73","resolution":{"observed_at":"2026-08-07T13:51:30.172115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-07-06T10:29:18.734092Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-07T13:51:30.283897Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.283897Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:d519354525c66f37625cdb0f9f729e7fcf135c831bab813df3fedb51290d710c","observation_id":"40fe7018-00db-4a51-b04d-e499630d74b1","resolution":{"observed_at":"2026-08-07T13:51:30.283897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:30.419313Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.419313Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:5cdf04754b89450f0c874dfbaa3a2e72659949d6fc6def409c36676241db01d2","observation_id":"7111f309-f56c-4ba1-87f8-00dfacea7d3d","resolution":{"observed_at":"2026-08-07T13:51:30.419313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06668","last_updated":"2024-02-13T22:37:39Z","snapshot_observed_at":"2026-07-06T16:46:06.801011Z","submitted_at":"2023-11-11T21:19:44Z","title":"In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.06668","snapshot_observed_at":"2026-08-07T13:51:30.523157Z","title":"In-context vectors: M aking in context learning more effective and controllable through latent space steering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.523157Z"},"links":{"cited_paper":"/paper/2311.06668","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:b44e805c77434eccdc64f0dede472f03d7a9251093d9a3e89985ed5471acbcd4","observation_id":"13348acd-44ee-4db0-94e9-24d1cfb78f51","resolution":{"observed_at":"2026-08-07T13:51:30.523157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09353","last_updated":"2024-07-09T05:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-14T17:59:34Z","title":"DoRA: Weight-Decomposed Low-Rank Adaptation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09353","snapshot_observed_at":"2026-08-07T13:51:30.658732Z","title":"DoRA : Weight-decomposed low-rank adaptation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.658732Z"},"links":{"cited_paper":"/paper/2402.09353","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:2787bf4519740c03d4717ddfef8518be9d07eef1db3e346ba073d47b9d3f80ad","observation_id":"15d07ed5-68d4-48fb-aa16-0616906645f8","resolution":{"observed_at":"2026-08-07T13:51:30.658732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-07T13:51:30.773603Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.773603Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:efc7cf588b78a2d1c87c5bbdd2e7b34943050ccf427fbab88c168d0037f98523","observation_id":"37142146-adca-407a-ba3c-8ef3a2f95107","resolution":{"observed_at":"2026-08-07T13:51:30.773603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-03T02:02:15.325394Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-07T13:51:30.846708Z","title":"SimPO : Simple preference optimization with a reference-free reward","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.846708Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:7b73527410e4f4d4026d3185ff76ce42c2aebf877327f0bab3d30774514d5ff5","observation_id":"83135dab-87ed-40d9-ab41-8082ed5c4dbc","resolution":{"observed_at":"2026-08-07T13:51:30.846708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.754703Z","title":"Interpreting GPT : The logit lens","venue":null,"work_id":"62f61784-8b4f-4b00-ab69-71f2f375bc32","year":2020},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.918405Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:5ae5db997179d46426430513bac27808f7cb4ec62b17d3dfc2d0636f4c44d26a","observation_id":"51d3b474-35fc-4f9b-9028-fd6b2330b64e","resolution":{"observed_at":"2026-08-07T13:51:36.854001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11695","last_updated":"2024-10-06T17:34:26Z","snapshot_observed_at":"2026-07-06T18:32:19.794373Z","submitted_at":"2024-06-17T16:12:03Z","title":"Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11695","snapshot_observed_at":"2026-08-07T13:51:30.997743Z","title":"Optimizing instructions and demonstrations for multi-stage language model programs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:30.997743Z"},"links":{"cited_paper":"/paper/2406.11695","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:5312003b591478f9c73860a32925fa8ee614c1fe90f6d614789af2f4de5cc5e7","observation_id":"bcaa0cc7-742a-4480-8725-d4d226cacc5a","resolution":{"observed_at":"2026-08-07T13:51:30.997743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-07T13:51:31.049946Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.049946Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:aeac30c46556548cd61374f2cbf1b394164186bb4158f918e4c25b482cda380e","observation_id":"a37a7295-7bf2-4ed9-ac6c-5fee920f2aaa","resolution":{"observed_at":"2026-08-07T13:51:31.049946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T13:51:31.125560Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.125560Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:bc7ba7c2daea4ba3196680a075d5cd7d1146bc04644e81ee4a7853d87dc50355","observation_id":"46dbe10f-3320-4d24-b24c-0843437fddcd","resolution":{"observed_at":"2026-08-07T13:51:31.125560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12091","last_updated":"2024-12-17T04:09:21Z","snapshot_observed_at":"2026-08-05T03:41:56.399189Z","submitted_at":"2022-01-28T13:00:17Z","title":"Linear Adversarial Concept Erasure","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12091","snapshot_observed_at":"2026-08-07T13:51:31.209159Z","title":"Cotterell","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.209159Z"},"links":{"cited_paper":"/paper/2201.12091","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:1957c64cb7cf786b0dacdf75e1bfc58e3e3a7db6463c73c9b67a74e07c78cfd3","observation_id":"05a59e27-a231-4840-b0c5-e713e70cddee","resolution":{"observed_at":"2026-08-07T13:51:31.209159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-07T13:51:31.313198Z","title":"Steering Llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.313198Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:3c249a40d639ac85549cc025367778ce3d32b005ff036311d82460686f00f60f","observation_id":"6410f9b9-b2ca-4552-bda9-752817345f3c","resolution":{"observed_at":"2026-08-07T13:51:31.313198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:51:31.390790Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.390790Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:cd5be5915458a5ade2724edfc12a28d6054ce3cdf6485834c5eab9cb71b99fe1","observation_id":"772b1ff9-923e-4bc6-97ef-137ca9f32547","resolution":{"observed_at":"2026-08-07T13:51:31.390790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.591722Z","title":"Slora: Scalable serving of thousands of lora adapters","venue":null,"work_id":"5487a63c-db08-47d0-a894-8c9e102e1fb8","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.480339Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:11351a777411fea3516a1198cc435ba4b14fea661caf6a498cb8a09a6a025b44","observation_id":"c0f56366-46b5-49c3-818a-bdbab4820874","resolution":{"observed_at":"2026-08-07T13:51:36.673034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09631","last_updated":"2025-06-04T06:03:19Z","snapshot_observed_at":"2026-08-06T20:07:42.029907Z","submitted_at":"2024-02-15T00:20:30Z","title":"Representation Surgery: Theory and Practice of Affine Steering","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09631","snapshot_observed_at":"2026-08-07T13:51:31.572050Z","title":"MiMiC : Minimally modified counterfactuals in the representation space","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.572050Z"},"links":{"cited_paper":"/paper/2402.09631","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:10d1684a7ae3103b8149223c792cfde940536743ed3a86cafc931922524f081d","observation_id":"d18869ff-4106-4176-9e38-74c91a57d243","resolution":{"observed_at":"2026-08-07T13:51:31.572050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05124","last_updated":"2022-05-10T19:04:37Z","snapshot_observed_at":"2026-08-08T01:27:21.861290Z","submitted_at":"2022-05-10T19:04:37Z","title":"Extracting Latent Steering Vectors from Pretrained Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05124","snapshot_observed_at":"2026-08-07T13:51:31.709484Z","title":"Extracting latent steering vectors from pretrained language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.709484Z"},"links":{"cited_paper":"/paper/2205.05124","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:da667590c213a9dc8e5679c438c6cbfa53c5ff03b7736b03fdf0c9d42a4f3821","observation_id":"1f35f1e4-2447-4a26-bde2-41621eebe10a","resolution":{"observed_at":"2026-08-07T13:51:31.709484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-07T13:51:31.851524Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.851524Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:022879c40ac0fcf69ff2fc30e36bfe404ebc713da1d166d7341582657c51a547","observation_id":"41e3a519-2743-4fb8-9775-2c491420c7e6","resolution":{"observed_at":"2026-08-07T13:51:31.851524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.432290Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":"52a2c242-7419-47c8-ac3b-c78f242ccaa3","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:31.998114Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:6c2d712507628e3838d69c30d3b3c5574de774d93990e43c4469e92996ddf2de","observation_id":"aa0ca1b7-ad63-4611-92e7-6ccb77ad6948","resolution":{"observed_at":"2026-08-07T13:51:36.504178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-07T13:51:32.169672Z","title":"Activation addition: Steering language models without optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.169672Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:2b0b21777604df9ac5730bdd65203819b4049ff989d20dc72167d270c6879459","observation_id":"c7517e6c-05a8-426d-b48b-4fc500dec4ca","resolution":{"observed_at":"2026-08-07T13:51:32.169672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.277324Z","title":"Steering gemini using BiPO vectors","venue":null,"work_id":"7ceffa87-8128-4c9d-9137-27057a6f081f","year":2025},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.335965Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:54326059f98cf18d7fafcf94a5a4926da025019800c2a1497ef2f6c696a657b5","observation_id":"f0799785-f431-4003-9b6b-0e1909b6a5d7","resolution":{"observed_at":"2026-08-07T13:51:36.321985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.214607Z","title":"Understanding and controlling a maze-solving policy network","venue":null,"work_id":"30961836-8700-4ef7-8b8e-e8fef7e75147","year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.483115Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:062e816c40774d7d99b5ec204ec2aa9aad895f1a036510fe69347f3793e974a0","observation_id":"6f6fc24f-1f47-4d6a-bc27-6681e88fdcf3","resolution":{"observed_at":"2026-08-07T13:51:36.241221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07558","last_updated":"2023-04-19T04:28:24Z","snapshot_observed_at":"2026-07-06T14:05:06.502938Z","submitted_at":"2022-10-14T06:29:22Z","title":"DyLoRA: Parameter Efficient Tuning of Pre-trained Models using Dynamic Search-Free Low-Rank Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07558","snapshot_observed_at":"2026-08-07T13:51:32.636087Z","title":"DyLoRA : Parameter efficient tuning of pre-trained models using dynamic search-free low-rank adaptation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.636087Z"},"links":{"cited_paper":"/paper/2210.07558","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:eb99750380f254b43faf113e3cab81b682b3bb2dc8a5412dd9c3b71ae960b259","observation_id":"1757c84d-87db-4395-a5a5-27fc1efb638a","resolution":{"observed_at":"2026-08-07T13:51:32.636087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05767","last_updated":"2024-03-09T02:30:04Z","snapshot_observed_at":"2026-08-01T01:37:54.238235Z","submitted_at":"2024-03-09T02:30:04Z","title":"Extending Activation Steering to Broad Skills and Multiple Behaviours","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05767","snapshot_observed_at":"2026-08-07T13:51:32.766155Z","title":"Extending activation steering to broad skills and multiple behaviours","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.766155Z"},"links":{"cited_paper":"/paper/2403.05767","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:4877be5c4d22b8dad699e9536123e27e772078605c6a0e9ffbe6f3cc5fd9911e","observation_id":"90328a18-47e1-429c-9010-6bbb5cd08e8b","resolution":{"observed_at":"2026-08-07T13:51:32.766155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:36.116254Z","title":"Attention is all you need","venue":null,"work_id":"35ce8460-2fcd-477c-bb55-cd91d8ef6378","year":2017},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:32.882551Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:81942f9f1e692bf5ec03182018919260330eb2c83cb8ad3bc0869afb1ef61a2c","observation_id":"c9f47152-b914-4493-972d-dab9b8c19cf0","resolution":{"observed_at":"2026-08-07T13:51:36.203312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:35.783180Z","title":"repeng, 2024","venue":null,"work_id":"87853adb-c623-4aa6-a32c-b99a93401431","year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.002679Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:52fb300bdbd312b43a8ab66b75a9223fb7877ba7e29b19cee71697eeedae756a","observation_id":"2cc57b4d-6abb-4f0b-98b0-734793afab5c","resolution":{"observed_at":"2026-08-07T13:51:35.944310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12410","last_updated":"2022-11-02T02:47:17Z","snapshot_observed_at":"2026-08-07T19:57:36.466885Z","submitted_at":"2022-05-24T23:41:22Z","title":"AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12410","snapshot_observed_at":"2026-08-07T13:51:33.164981Z","title":"AdaMix : Mixture-of-adaptations for parameter-efficient model tuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.164981Z"},"links":{"cited_paper":"/paper/2205.12410","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c2c0a4122ef59eb218c075e5380b88a82ee0d27ef0fe13436e8ccca6ca03dc06","observation_id":"7990c06a-efa4-4d54-95b0-227bd7fd8f16","resolution":{"observed_at":"2026-08-07T13:51:33.164981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:51:35.433697Z","title":"Orthogonal negation in vector spaces for modelling word-meanings and document retrieval","venue":null,"work_id":"deb8b21a-9682-471e-bd2d-ee03a179bdd1","year":2003},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.285309Z"},"links":{"citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:f22e6e5198a70eaa16afe8b1cb03e76239fc49aa407b66913bb9342f3b9a50f2","observation_id":"c6988739-40c6-4add-89dd-0b2fe6ce3f83","resolution":{"observed_at":"2026-08-07T13:51:35.615257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03592","last_updated":"2024-05-22T17:52:31Z","snapshot_observed_at":"2026-07-06T17:55:44.838732Z","submitted_at":"2024-04-04T17:00:37Z","title":"ReFT: Representation Finetuning for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03592","snapshot_observed_at":"2026-08-07T13:51:33.386643Z","title":"Manning, and Christopher Potts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.386643Z"},"links":{"cited_paper":"/paper/2404.03592","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:cbb4d3323d70af86f982509c7216dec0f0e55fd7bfb166096f317c8192d5793f","observation_id":"b6492f5f-0acb-4fb3-8926-87e8a136e00f","resolution":{"observed_at":"2026-08-07T13:51:33.386643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-07T21:53:39.823463Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-07T13:51:33.503653Z","title":"Manning, and Christopher Potts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.503653Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:12d0ba9d35b5516039c7a5ebfd0baa43c3f0fa04654e555dcf08c69adb7307b6","observation_id":"0bbd5b28-16ef-422c-85fd-6ec1fde77f96","resolution":{"observed_at":"2026-08-07T13:51:33.503653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14870","last_updated":"2023-12-09T02:46:08Z","snapshot_observed_at":"2026-08-03T10:10:49.848317Z","submitted_at":"2023-06-26T17:33:21Z","title":"Composing Parameter-Efficient Modules with Arithmetic Operations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14870","snapshot_observed_at":"2026-08-07T13:51:33.662041Z","title":"Composing parameter-efficient modules with arithmetic operation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.662041Z"},"links":{"cited_paper":"/paper/2306.14870","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c9cea8f901c5e9f22056f8e5d90b4282dc4e9a6776c0b0267250724c2785e6ff","observation_id":"f93f2473-2f5b-411b-8c8a-9d04c0715e2d","resolution":{"observed_at":"2026-08-07T13:51:33.662041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10512","last_updated":"2023-12-20T20:56:14Z","snapshot_observed_at":"2026-07-06T15:05:16.471478Z","submitted_at":"2023-03-18T22:36:25Z","title":"AdaLoRA: Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.10512","snapshot_observed_at":"2026-08-07T13:51:33.779422Z","title":"AdaLoRA : Adaptive budget allocation for parameter-efficient fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.779422Z"},"links":{"cited_paper":"/paper/2303.10512","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:733524cb8b7cb22433535fe37e3b2290b486f320fe3b7d8fd5fbf1237b7aa96a","observation_id":"954511ad-e108-4f63-ad74-7e3fac27b012","resolution":{"observed_at":"2026-08-07T13:51:33.779422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09113","last_updated":"2024-03-17T17:55:47Z","snapshot_observed_at":"2026-07-06T17:44:21.659847Z","submitted_at":"2024-03-14T05:29:35Z","title":"AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09113","snapshot_observed_at":"2026-08-07T13:51:33.904931Z","title":"AutoLoRA : Automatically tuning matrix ranks in low-rank adaptation based on meta learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:33.904931Z"},"links":{"cited_paper":"/paper/2403.09113","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:c224d8f0c9ccb2079aec73bcc10f09c05d656d3d38a22bb0af60172c81b5e4d2","observation_id":"7e36d3e4-ab68-4dec-b32e-e684e1974427","resolution":{"observed_at":"2026-08-07T13:51:33.904931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00732","last_updated":"2024-04-29T04:01:45Z","snapshot_observed_at":"2026-07-06T18:08:21.770341Z","submitted_at":"2024-04-29T04:01:45Z","title":"LoRA Land: 310 Fine-tuned LLMs that Rival GPT-4, A Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00732","snapshot_observed_at":"2026-08-07T13:51:34.066196Z","title":"Lora land: 310 fine-tuned llms that rival gpt-4, a technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:34.066196Z"},"links":{"cited_paper":"/paper/2405.00732","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:b8ea3f1887accc72a48780f542b4e397a2e9b9702727de65b7d8e83c8ec8d771","observation_id":"fb1522d2-d229-43ef-bbd1-a2a0d30523a8","resolution":{"observed_at":"2026-08-07T13:51:34.066196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T13:51:34.174104Z","title":"Instruction-following evaluation for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:34.174104Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:25fda868623c89f89aa621f72b0138d79a7f41ccc1afa7af458597d6251ca1fb","observation_id":"759d367a-03b2-4e16-ad45-ba905d1a315a","resolution":{"observed_at":"2026-08-07T13:51:34.174104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T13:51:34.287635Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T13:51:34.287635Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.20809"},"observation_digest":"sha256:0a6803e9a2d8849b00cfd98c4f1becdc8644a81d342cfe854928c9a915c0cbd3","observation_id":"79ae279f-7795-44cf-9433-03c3ed5a7d7e","resolution":{"observed_at":"2026-08-07T13:51:34.287635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20809","last_updated":"2025-05-27T07:16:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T21:54:12.571328Z","submitted_at":"2025-05-27T07:16:40Z","title":"Improved Representation Steering for Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 7 inbound Pith citation observations for arXiv:2505.20809."}