{"as_of":"2026-07-31T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:115e9105f7c01d9d000444e2bdb8ae1157cd2327a86294d34e5d7eb63388ff8e","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":123,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":123,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-31T06:34:12.847434+00:00","state":"measured"},{"denominator":336,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-15T14:15:29.705679Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T15:37:20.411640Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2310.19852","last_updated":"2025-04-04T11:14:49Z","snapshot_observed_at":"2026-07-06T16:40:43.536565Z","submitted_at":"2023-10-30T15:52:15Z","title":"AI Alignment: A Comprehensive Survey","version":6},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-17T14:28:48.987140Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2310.19852"},"observation_digest":"sha256:1eaa71fcf8e0f3f25401e23c09ec6e5a6104733244293381a8781a65d4ef1074","observation_id":"a8d08171-95b0-4a21-aff0-fa279eaa9dcf","resolution":{"observed_at":"2026-05-17T14:28:49.016239Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T21:43:28.274354Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2311.03658"},"observation_digest":"sha256:af1bc6a19f586861054dc647bb86d4da9ffc1996f86c5145251f833417770c49","observation_id":"c909f869-1d84-4ec2-aab2-17f6a6155805","resolution":{"observed_at":"2026-05-11T21:43:30.838860Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-11T20:37:20.408376Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2312.06681"},"observation_digest":"sha256:b20ea15607e3251108c90eb6bbf0f60b69fac0ac56e1c578ebfc33f64e00371d","observation_id":"7739f3cb-6554-467d-b692-df57b12dbaeb","resolution":{"observed_at":"2026-05-11T20:37:21.300128Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-13T13:15:10.632115Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2403.19647"},"observation_digest":"sha256:338740a9bbaafe4f91f1f044be0e4099c6fafd16de11342dbbb58ec6e2246714","observation_id":"72bf91dd-6833-45d9-ab54-708e9c017267","resolution":{"observed_at":"2026-05-13T13:15:10.727523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":207,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:8997134b430c29976340b218f568ef272d6ee923128305da1b9de7daf1359258","observation_id":"762be8d1-2052-45c4-8f55-2c7d8c9da9fe","resolution":{"observed_at":"2026-05-13T10:47:56.176618Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2406.15927","last_updated":"2024-06-22T19:46:06Z","snapshot_observed_at":"2026-07-30T04:59:24.269176Z","submitted_at":"2024-06-22T19:46:06Z","title":"Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-18T00:52:02.421389Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2406.15927"},"observation_digest":"sha256:1ce7281a6caeb28c0467ff39727d915dae1e124c232109bbdbce2d7eafbbcf04","observation_id":"974adf50-0bce-4cc9-a758-21066380b6a0","resolution":{"observed_at":"2026-05-18T00:52:02.604208Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2410.02064","last_updated":"2025-04-22T01:24:23Z","snapshot_observed_at":"2026-07-06T19:26:38.002071Z","submitted_at":"2024-10-02T22:26:21Z","title":"Inspection and Control of Self-Generated-Text Recognition Ability in Llama3-8b-Instruct","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-23T19:51:14.630756Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2410.02064"},"observation_digest":"sha256:d67794b060bdf5073f47baab07a854a1ce9b1d731cb54296e090d4644ed2c770","observation_id":"a003612c-133c-4085-907e-c3e67ca4a966","resolution":{"observed_at":"2026-05-23T19:53:23.230920Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2501.16496"},"observation_digest":"sha256:3b798d2ee09f9f78fd1813cf589c04a2152d5d74bc9cbbc027fa79c982b23375","observation_id":"f996f9eb-11eb-4278-843d-81c8ac638337","resolution":{"observed_at":"2026-05-14T18:30:06.022244Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2503.02574","last_updated":"2026-05-18T17:54:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-04T12:55:07Z","title":"LLM-Safety Evaluations Lack Robustness","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-23T01:26:45.402983Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2503.02574"},"observation_digest":"sha256:68437b207d234f8443036353dd876965f2e1b3e08d37ea7a9228a5857a675689","observation_id":"47bc9731-5628-4577-ab9e-28c298906cd5","resolution":{"observed_at":"2026-05-23T01:27:21.335303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-21T07:24:12.845841Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2503.11926"},"observation_digest":"sha256:14ab1de91181d481339c6d81664a6e85995ccb2e94398d597fdfdcc6f1eb4002","observation_id":"ca3411fb-7f32-44d6-a529-5f2db1051007","resolution":{"observed_at":"2026-05-21T07:24:13.007302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2505.16737","last_updated":"2026-04-23T08:31:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-22T14:52:10Z","title":"Secure LLM Fine-Tuning via Safety-Aware Probing","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T13:07:09.402763Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.16737"},"observation_digest":"sha256:9bba419ed179dea924d7c0efd749f238895117888cfa2fba5f9ea87acc456d77","observation_id":"467663c3-9f95-4987-b99c-0198592831fd","resolution":{"observed_at":"2026-05-22T13:11:35.874410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2506.00166","last_updated":"2026-04-30T20:54:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-30T19:11:52Z","title":"Disentangled Safety Adapters Enable Efficient Guardrails and Flexible Inference-Time Alignment","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-19T11:52:36.688263Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.00166"},"observation_digest":"sha256:4d72673e44974288866b97291d1934d2fff3794f2cb7b2da01ef23749d536fec","observation_id":"cc9d089b-3a7b-41d9-9773-441baa675efe","resolution":{"observed_at":"2026-05-19T11:53:03.601789Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2506.01770","last_updated":"2026-04-18T05:40:12Z","snapshot_observed_at":"2026-07-06T21:35:03.439393Z","submitted_at":"2025-06-02T15:17:38Z","title":"ReGA: Model-Based Safeguard for LLMs via Representation-Guided Abstraction","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T11:34:09.428653Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.01770"},"observation_digest":"sha256:0dd164bf9001a1cb466e8efed42ded1ac7662d726bd1528777fc53a6dc85249f","observation_id":"c0284196-7fd1-4e22-8b2e-f939c54795d0","resolution":{"observed_at":"2026-05-19T11:37:15.901459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2506.14387","last_updated":"2026-04-20T20:19:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T10:33:23Z","title":"SEAT: Sparse Entity-Aware Tuning for Knowledge Adaptation while Preserving Epistemic Abstention","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T09:34:24.194855Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.14387"},"observation_digest":"sha256:bf7614d37ae65bc5580c3efabdec53ea29ec5a2ab50f316c8603c3b45aedcf15","observation_id":"93e4d6bd-b054-4117-b748-264fab7490fc","resolution":{"observed_at":"2026-05-19T09:37:14.191045Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2507.08110","last_updated":"2026-04-20T16:02:12Z","snapshot_observed_at":"2026-07-06T21:55:21.878346Z","submitted_at":"2025-07-10T18:52:50Z","title":"AI Feedback Enhances Community-Based Content Moderation through Engagement with Counterarguments","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T05:23:00.858183Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.08110"},"observation_digest":"sha256:f26078ba282151b724c086f220c75ad394c4cdc7b96842480b1c8a1d18fa7431","observation_id":"767a7f2d-419b-4a88-b238-07a6b491e0db","resolution":{"observed_at":"2026-05-19T05:27:05.576965Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2509.18218","last_updated":"2026-04-06T17:04:13Z","snapshot_observed_at":"2026-07-06T22:30:31.933240Z","submitted_at":"2025-09-21T22:34:00Z","title":"Similarity Field Theory: A Mathematical Framework for Intelligence","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-18T14:36:49.543497Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2509.18218"},"observation_digest":"sha256:6431037d04fac27d67638375b05c93ee4bd0d02d1ca68baac0394dfc46695fa3","observation_id":"faa59524-a754-4429-91de-85cb5b050602","resolution":{"observed_at":"2026-05-18T14:41:30.673119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2509.22739","last_updated":"2026-05-15T15:16:23Z","snapshot_observed_at":"2026-07-06T22:30:55.313733Z","submitted_at":"2025-09-25T23:25:47Z","title":"Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T21:44:36.351517Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2509.22739"},"observation_digest":"sha256:75c2692ff00bf2e8958eb0e40040f7390ae6c289715ec1048fe0f02a3ded8483","observation_id":"9d68e2ae-6f90-4bc3-b11f-fe9cec573840","resolution":{"observed_at":"2026-05-21T21:45:40.623814Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2511.02356","last_updated":"2026-04-20T12:25:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-04T08:24:22Z","title":"ASTRA: An Automated Framework for Strategy Discovery, Retrieval, and Evolution for Jailbreaking LLMs","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T01:54:22.995178Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2511.02356"},"observation_digest":"sha256:628b616ce3b24abe4468edf49fb340ae787e3626ce15e260698b0a3718f5c708","observation_id":"e86d5acf-2b40-4fbb-b48f-c9f716086568","resolution":{"observed_at":"2026-05-18T01:55:38.026427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2511.06516","last_updated":"2026-06-28T18:20:13Z","snapshot_observed_at":"2026-07-06T22:35:18.393401Z","submitted_at":"2025-11-09T19:58:24Z","title":"You Had One Job: Per-Task Quantization Using LLMs' Hidden Representations","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-21T18:46:04.926179Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2511.06516"},"observation_digest":"sha256:b35fb3a351d6a70cbd084cafb9e23d244b769ede8d1af25f31eeef6ccca72694","observation_id":"9c81199a-9595-447f-98ff-0752ae4c49d0","resolution":{"observed_at":"2026-05-21T18:50:30.288269Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2511.17408","last_updated":"2026-04-19T21:58:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-21T17:08:48Z","title":"The Impact of Off-Policy Training Data on Probe Generalisation","version":4},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-17T20:26:37.914522Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2511.17408"},"observation_digest":"sha256:a7fdf938e8b5bc4d945f3d308ac30ada24b9c41ce864f58bed098334d43d9dc4","observation_id":"d506ccca-0558-4d99-a37f-5f0ee8994d3b","resolution":{"observed_at":"2026-05-17T20:30:11.744338Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2512.12469","last_updated":"2026-04-25T18:15:35Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-13T21:43:17Z","title":"Sparse Concept Anchoring for Interpretable and Controllable Neural Representations","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T22:14:40.293207Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2512.12469"},"observation_digest":"sha256:82be56e7632a5b4d842a11f1e3c2a902e07bc71cf69ad63e6b43f5f38fe02db4","observation_id":"67e7d001-9de5-48e8-b2af-5f9bedfcfbdf","resolution":{"observed_at":"2026-05-16T22:18:36.673480Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2602.02280","last_updated":"2026-05-12T03:47:11Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:20:51Z","title":"RACC: Representation-Aware Coverage Criteria for LLM Safety Testing","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:55.296932Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2602.02280"},"observation_digest":"sha256:cb626012550d33ffabe80f1d65d757d2c1b032951c6f98fe9752973c11393611","observation_id":"7ad837fd-5640-4b52-9a39-1805d0bafb83","resolution":{"observed_at":"2026-05-16T08:17:36.626928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2602.11824","last_updated":"2026-05-11T06:09:34Z","snapshot_observed_at":"2026-07-06T22:45:39.557598Z","submitted_at":"2026-02-12T11:07:44Z","title":"Revis: Sparse Latent Steering to Mitigate Object Hallucination in Large Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T05:06:24.973439Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2602.11824"},"observation_digest":"sha256:d4bbc843181afceb3e1f36650b46b1237414c259a75c9528ed11a0cf9fc5fef9","observation_id":"40248c51-1738-4687-8d8b-9f4f026f8451","resolution":{"observed_at":"2026-05-16T05:07:20.474413Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-15T14:15:29.705679Z","title":"Representation engineering: A top-down approach to ai transparency,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.05813","last_updated":"2026-06-17T06:35:29Z","snapshot_observed_at":"2026-07-15T14:15:29.430944Z","submitted_at":"2026-03-06T01:54:28Z","title":"Activation Steering for Accent Adaptation in Large Audio Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-15T14:15:29.705679Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2603.05813"},"observation_digest":"sha256:8ba59d3eb6f85f2045b0e03fff9349e2296122026f07d74172d1c9df968018fa","observation_id":"b558ed84-735a-4a84-8cec-4ed510f8d4c7","resolution":{"observed_at":"2026-07-15T14:15:29.705679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-14T22:34:21.790260Z","title":"psychologi- cal creativity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.11863","last_updated":"2026-06-11T09:00:22Z","snapshot_observed_at":"2026-07-14T22:34:20.927460Z","submitted_at":"2026-03-12T12:36:56Z","title":"CreativeBench: Benchmarking and Enhancing Machine Creativity via Self-Evolving Challenges","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T22:34:21.790260Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2603.11863"},"observation_digest":"sha256:526b3988e34cff76a10fcb928e29969300da64a88e40ffce392a02b67b6ca99c","observation_id":"6233aaca-4963-43cd-bdc8-e40c11749af3","resolution":{"observed_at":"2026-07-14T22:34:21.790260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-13T16:04:03.659837Z","title":"Representation engineering: A top-down approach to AI transparency.arXiv preprint arXiv:2310.01405, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.28919","last_updated":"2026-06-21T23:22:45Z","snapshot_observed_at":"2026-07-30T12:03:25.282397Z","submitted_at":"2026-03-30T18:51:50Z","title":"Why That Robot? A Qualitative Analysis of Justification Strategies for Robot Color Selection Across Occupational Contexts","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T16:04:03.659837Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2603.28919"},"observation_digest":"sha256:f21cab91f7d360cd9b4938c1fd56155a34c7309eafae444a912358d84ead2843","observation_id":"a7e97ba6-73e4-4bb9-8dbd-972fe09300d2","resolution":{"observed_at":"2026-07-13T16:04:03.659837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2603.28921","last_updated":"2026-07-12T21:16:07Z","snapshot_observed_at":"2026-07-16T23:18:41.241957Z","submitted_at":"2026-03-30T18:53:03Z","title":"Critical Damping as a Momentum Schedule: Multi-Seed Validation, a Hybrid Recipe, and an Exhaustive Negative Result on Surgical Layer Selection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:37:07.118251Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2603.28921"},"observation_digest":"sha256:0b4670ff4827a521134a43f7a0e2469bcba0ac56894f128b71f2983899331b0f","observation_id":"16a9e383-eb52-4b32-8cb9-5b01e20e00da","resolution":{"observed_at":"2026-05-14T21:38:00.031448Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-13T14:23:49.346727Z","title":"Representation engineering: A top-down approach to ai transparency.arXiv preprint arXiv:2310.01405,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01475","last_updated":"2026-06-08T13:23:37Z","snapshot_observed_at":"2026-07-13T14:23:49.176171Z","submitted_at":"2026-04-01T23:31:38Z","title":"Interpretable Electrophysiological Features of Resting-State EEG Capture Cortical Network Dynamics in Parkinsons Disease","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T14:23:49.346727Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.01475"},"observation_digest":"sha256:fc6b99cf496c7b8f45f639fcf7a5f821de286a5004c7ac234f87100d76935267","observation_id":"7e85a505-08d8-4b05-8b5b-2bbe3c106fd7","resolution":{"observed_at":"2026-07-13T14:23:49.346727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-13T13:46:54.451163Z","title":"remarkably robust","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.02607","last_updated":"2026-06-04T23:33:21Z","snapshot_observed_at":"2026-07-13T13:46:53.614216Z","submitted_at":"2026-04-03T00:52:20Z","title":"Dual Implications of Quark Mass Hierarchies to Flavor Structure","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T13:46:54.451163Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.02607"},"observation_digest":"sha256:94df523af0518d3b8ee021921089ed3543f0cfc924b0a3c0d7b7237ca24da5a2","observation_id":"90631e93-3173-49a6-a13d-66d31491d0cc","resolution":{"observed_at":"2026-07-13T13:46:54.451163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.02608","last_updated":"2026-05-08T22:54:43Z","snapshot_observed_at":"2026-07-06T22:51:57.889822Z","submitted_at":"2026-04-03T00:54:11Z","title":"Steerable but Not Decodable: Function Vectors Operate Beyond the Logit Lens","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T20:59:02.824707Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.02608"},"observation_digest":"sha256:4ba604ab7681e9b4f4600d7ea28d3cab6f090c284ed71943c0deb6c614e7f970","observation_id":"d12cec21-60f2-4a68-9b63-79135c52db13","resolution":{"observed_at":"2026-05-13T21:03:20.239459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-13T13:35:02.428552Z","title":"arXiv preprint arXiv:2310.01405(2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03042","last_updated":"2026-06-04T11:31:33Z","snapshot_observed_at":"2026-07-31T07:47:09.825048Z","submitted_at":"2026-04-03T13:51:23Z","title":"Enhancing Multi-Robot Exploration Using Probabilistic Frontier Prioritization with Dirichlet Process Gaussian Mixtures","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T13:35:02.428552Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.03042"},"observation_digest":"sha256:0fe266ad4fc4f327edf2565ae163a6a4d73be486a4ba38c9cdaa5f503edc71ac","observation_id":"68592d14-f536-4c61-b56c-578299073119","resolution":{"observed_at":"2026-07-13T13:35:02.428552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.03045","last_updated":"2026-04-03T13:52:57Z","snapshot_observed_at":"2026-07-06T22:52:20.577677Z","submitted_at":"2026-04-03T13:52:57Z","title":"STEAR: Layer-Aware Spatiotemporal Evidence Intervention for Hallucination Mitigation in Video Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T20:16:04.999705Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.03045"},"observation_digest":"sha256:6f4d5c88afb9b6555db8df1e69fe2dd22a2ac553f0e2da1a595d4d5e204f77ad","observation_id":"7483e0d1-8b6b-4e8c-a63c-7fd4d199cffe","resolution":{"observed_at":"2026-05-13T20:18:13.365221Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.03147","last_updated":"2026-05-08T16:54:46Z","snapshot_observed_at":"2026-07-31T15:50:04.905362Z","submitted_at":"2026-04-03T16:08:05Z","title":"Valence-Arousal Subspace in LLMs: Circular Emotion Geometry and Multi-Behavioral Control","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T20:15:41.756907Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.03147"},"observation_digest":"sha256:73606cbbda9b6ac40a246b38d559e25fc25edaeec7a1e60977835396236c7ee2","observation_id":"f5d6f474-d6f1-4f5d-a118-bf05a504d1b6","resolution":{"observed_at":"2026-05-13T20:18:13.410647Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.03865","last_updated":"2026-04-04T21:05:31Z","snapshot_observed_at":"2026-07-06T22:52:57.182669Z","submitted_at":"2026-04-04T21:05:31Z","title":"The Democratic Ontology Deficit: How AI Systems Fail to Represent What Democracy Requires","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T16:50:53.440923Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.03865"},"observation_digest":"sha256:0540226829ecb4e63a374098030bfaf0ea0bff722bf51aa22789599c111462c5","observation_id":"ee097d1e-6886-4343-9699-5ad26e50246a","resolution":{"observed_at":"2026-05-13T16:53:00.117396Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-13T12:15:38.881394Z","title":"Represen- tation engineering: A top-down approach to ai transparency, 2023.URL https://arxiv","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.03867","last_updated":"2026-04-04T21:16:47Z","snapshot_observed_at":"2026-07-13T12:15:38.543755Z","submitted_at":"2026-04-04T21:16:47Z","title":"Where to Steer: Input-Dependent Layer Selection for Steering Improves LLM Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T12:15:38.881394Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.03867"},"observation_digest":"sha256:a1eb7d9ec5c239c9084c1f14161a305f53b90909c160bd0641540a02cc8b55ab","observation_id":"9b8d3568-179c-4390-98f6-f58858ce0fd5","resolution":{"observed_at":"2026-07-13T12:15:38.881394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.04385","last_updated":"2026-06-29T01:03:35Z","snapshot_observed_at":"2026-07-13T09:52:47.176183Z","submitted_at":"2026-04-06T03:20:37Z","title":"How Alignment Routes: Localizing, Scaling, and Controlling Policy Circuits in Language Models","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T20:09:51.378878Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.04385"},"observation_digest":"sha256:efd6400d59180d19f67b977c1cdbc6d214d27954aac15cb43f661c0b5063b9e3","observation_id":"db8ad889-984a-4ddc-850b-8fa31ba755a9","resolution":{"observed_at":"2026-05-10T22:10:50.518999Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.04946","last_updated":"2026-03-28T07:03:44Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-03-28T07:03:44Z","title":"Sparse Autoencoders as a Steering Basis for Phase Synchronization in Graph-Based CFD Surrogates","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T22:18:22.476746Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.04946"},"observation_digest":"sha256:32d0de01d187ff8e7c422cde5be1c16492608f391477ba99181e411ac35acf16","observation_id":"2d840371-9a51-4e69-8735-c9201f92d8aa","resolution":{"observed_at":"2026-05-14T22:19:31.717017Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.06377","last_updated":"2026-05-05T18:37:43Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T19:02:10Z","title":"The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:44.401045Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.06377"},"observation_digest":"sha256:d2b1802724b40e0cde828968a92892ffe512180d6749409821250674740892de","observation_id":"c40bc05c-648e-4552-9c3d-1ea7712e242e","resolution":{"observed_at":"2026-05-11T00:15:56.188766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.07098","last_updated":"2026-05-11T15:12:11Z","snapshot_observed_at":"2026-07-06T22:55:24.459130Z","submitted_at":"2026-04-08T13:51:07Z","title":"Selective Neuron Amplification in Transformer Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:31:17.182481Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.07098"},"observation_digest":"sha256:fa047ba1774dcbbbf19edf5deed9984b9335c09c76a6c0f930970fc2890f89a2","observation_id":"56bf7d92-05bc-4ca5-bd16-d69016395486","resolution":{"observed_at":"2026-05-11T00:25:52.313537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.07098","last_updated":"2026-05-11T15:12:11Z","snapshot_observed_at":"2026-07-06T22:55:24.459130Z","submitted_at":"2026-04-08T13:51:07Z","title":"Selective Neuron Amplification in Transformer Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T04:28:05.507808Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.07098"},"observation_digest":"sha256:6f9caaf91b576cd1db4d0df93fd810f99e8c148ebf390111403fc180765065e2","observation_id":"62121618-702f-4216-baff-ec075ff1d25c","resolution":{"observed_at":"2026-05-12T06:16:25.123020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.07729","last_updated":"2026-04-09T02:25:17Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:25:17Z","title":"Emotion Concepts and their Function in a Large Language Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:03:52.210931Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.07729"},"observation_digest":"sha256:f67011f8f976483a06cd28c8ded4112609c7b24098d1ffc5dc102558938a6c38","observation_id":"0cf4070d-27d7-4e8f-a76b-b6a47ca4b29e","resolution":{"observed_at":"2026-05-11T05:35:58.213915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.07749","last_updated":"2026-04-09T03:14:30Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T03:14:30Z","title":"Beyond Social Pressure: Benchmarking Epistemic Attack in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:27:43.273410Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.07749"},"observation_digest":"sha256:9698cc424272c36b124beaf1a413c4c85963d7c633b0ffc536daffbd03222ae0","observation_id":"23247e79-193c-49f3-8b41-a7cc10254a8f","resolution":{"observed_at":"2026-05-11T00:30:55.137260Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.07886","last_updated":"2026-04-13T10:44:52Z","snapshot_observed_at":"2026-07-06T22:57:05.146373Z","submitted_at":"2026-04-09T06:55:19Z","title":"Linear Representations of Hierarchical Concepts in Language Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-10T17:00:04.457449Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.07886"},"observation_digest":"sha256:b892bb1960fbf700a29652275d2445d06d3a7d5941a8eeabcafb1a1e344fc663","observation_id":"060b2fb4-f881-4a2e-99b3-b591ed7607e0","resolution":{"observed_at":"2026-05-11T07:45:57.607911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.08335","last_updated":"2026-04-09T15:07:44Z","snapshot_observed_at":"2026-07-06T22:57:26.678728Z","submitted_at":"2026-04-09T15:07:44Z","title":"Dead Weights, Live Signals: Feedforward Graphs of Frozen Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T17:53:35.970156Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.08335"},"observation_digest":"sha256:29881ddbc9d44a384f965745d00e75bbcf05e06fc1e840a7e96bb8c59337cd78","observation_id":"e7017615-6ff0-46cf-9956-da1f2311ae60","resolution":{"observed_at":"2026-05-11T05:55:57.478701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.08524","last_updated":"2026-04-09T17:57:14Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:57:14Z","title":"What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-10T17:47:43.189696Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.08524"},"observation_digest":"sha256:9ed7f412626cc46511f47be1c5a3275627bf505b2622584e0e978037630db26e","observation_id":"7420bd99-1623-4271-b4c9-9dc983399cd6","resolution":{"observed_at":"2026-05-11T06:05:59.837702Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.08525","last_updated":"2026-04-09T17:57:50Z","snapshot_observed_at":"2026-07-06T22:57:35.435713Z","submitted_at":"2026-04-09T17:57:50Z","title":"Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-05-10T17:11:13.189660Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.08525"},"observation_digest":"sha256:181a419dd1303340b6b29e8c6ad3070d9be5ff570cffbd53a8b9ade800af7257","observation_id":"a79a4202-5578-4dad-b4f2-29b5bde62af8","resolution":{"observed_at":"2026-05-11T07:26:02.224964Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.08844","last_updated":"2026-04-10T00:53:30Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-10T00:53:30Z","title":"Spectral Geometry of LoRA Adapters Encodes Training Objective and Predicts Harmful Compliance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:10:42.847854Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.08844"},"observation_digest":"sha256:039de868fde142dec821e357ece2b6e1cd9cf272fb95b75c2b4bc7022ddb4bd1","observation_id":"51ea0f1b-925a-4579-a7d4-90f811fad919","resolution":{"observed_at":"2026-05-11T05:21:01.623782Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.08846","last_updated":"2026-04-10T01:01:56Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-10T01:01:56Z","title":"Dictionary-Aligned Concept Control for Safeguarding Multimodal LLMs","version":1},"reference_index":134,"source":"pdf_text","source_observed_at":"2026-05-10T18:04:05.157103Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.08846"},"observation_digest":"sha256:0e92248e62a7c3398def4a02b22e74f18083340a0c966dc3d6c854ca4b11b525","observation_id":"4a9b941b-72e5-4e68-858c-319159b3be48","resolution":{"observed_at":"2026-05-11T05:35:57.476712Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.09213","last_updated":"2026-04-10T11:07:33Z","snapshot_observed_at":"2026-07-06T22:58:08.579543Z","submitted_at":"2026-04-10T11:07:33Z","title":"SHIFT: Steering Hidden Intermediates in Flow Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T18:33:59.134475Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.09213"},"observation_digest":"sha256:dc25ee97eebdacfc1e92a31aab4b2a105530ac68fa1b72c824a020be0314e6dc","observation_id":"d7b4aecb-48d8-4a4b-9fc7-57646ee8dd16","resolution":{"observed_at":"2026-05-11T00:20:55.675839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.11309","last_updated":"2026-04-13T11:12:30Z","snapshot_observed_at":"2026-07-30T17:13:57.164751Z","submitted_at":"2026-04-13T11:12:30Z","title":"The Salami Slicing Threat: Exploiting Cumulative Risks in LLM Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T16:07:31.602378Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.11309"},"observation_digest":"sha256:181bac81d2b10f18697a94fb0cd048d1a4a5b68ae4429e38049b2e6f83c755fd","observation_id":"dd40cf67-790e-4663-83db-6f2c8a1485c4","resolution":{"observed_at":"2026-05-11T09:16:03.947647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.11867","last_updated":"2026-04-13T17:40:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-13T17:40:31Z","title":"Disposition Distillation at Small Scale: A Three-Arc Negative Result","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:21.845152Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.11867"},"observation_digest":"sha256:0cb791e53f1782f1ac88dd59ced41247acce029b849284e4f039f95975cb40d0","observation_id":"8ac08129-784d-4f9b-abae-ae8e2a641f50","resolution":{"observed_at":"2026-05-11T09:16:00.987401Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.11943","last_updated":"2026-07-06T04:35:13Z","snapshot_observed_at":"2026-07-12T21:41:19.909380Z","submitted_at":"2026-04-13T18:32:02Z","title":"ProbeLogits: Kernel-Level LLM Inference Primitives for AI-Native Operating Systems","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T16:27:18.594869Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.11943"},"observation_digest":"sha256:7a8b3ea1230b240ed672e72814133ae98e2450add02e255aae084b8246919e16","observation_id":"7936659b-cb27-44e9-80a0-b1a03ceb3dd6","resolution":{"observed_at":"2026-05-11T08:50:59.101522Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.12210","last_updated":"2026-04-16T10:44:59Z","snapshot_observed_at":"2026-07-06T23:00:28.036409Z","submitted_at":"2026-04-14T02:37:46Z","title":"Beyond Prompt: Fine-grained Simulation of Cognitively Impaired Standardized Patients via Stochastic Steering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T15:55:12.611847Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.12210"},"observation_digest":"sha256:ee7a9f12108760da607bbf6338483072ffee050714d23b31ec58f730052d2c8a","observation_id":"bc9c2adb-b9c9-462e-ab72-d5f182d1dbe0","resolution":{"observed_at":"2026-05-11T09:36:07.724906Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.13082","last_updated":"2026-06-17T04:09:14Z","snapshot_observed_at":"2026-07-13T15:57:54.517771Z","submitted_at":"2026-03-30T22:20:38Z","title":"The Long Delay to Arithmetic Generalization: When Learned Representations Outrun Behavior","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-14T21:16:40.430384Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.13082"},"observation_digest":"sha256:bd69bd8766d681b558af826a21558adfecc69425c34be6f613bdaeecae8be55b","observation_id":"05cf5f90-b603-4160-b5a9-809c7e5cf764","resolution":{"observed_at":"2026-05-14T21:17:58.775434Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.13240","last_updated":"2026-06-18T16:20:59Z","snapshot_observed_at":"2026-07-12T20:55:34.039499Z","submitted_at":"2026-04-14T19:16:38Z","title":"A High-Resolution Landscape Dataset for Concept-Based XAI With Application to Species Distribution Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T16:26:32.447186Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.13240"},"observation_digest":"sha256:361bdba85f1c2cf8ea4150c4cf0788cb0123a1419fd7aec878d9002e5ea8e0ac","observation_id":"e4737c71-35e5-420a-b5dc-79642019ce16","resolution":{"observed_at":"2026-05-11T08:55:59.826347Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-12T20:55:34.837390Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.13240","last_updated":"2026-06-18T16:20:59Z","snapshot_observed_at":"2026-07-12T20:55:34.039499Z","submitted_at":"2026-04-14T19:16:38Z","title":"A High-Resolution Landscape Dataset for Concept-Based XAI With Application to Species Distribution Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-12T20:55:34.837390Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.13240"},"observation_digest":"sha256:2cb7e428ac101065b95b8d35874f9759106655755e310f94fe1b3a14eb5191e9","observation_id":"6eedbe06-41de-41b0-a9b8-0e54251012b2","resolution":{"observed_at":"2026-07-12T20:55:34.837390Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.13417","last_updated":"2026-04-15T02:34:37Z","snapshot_observed_at":"2026-07-06T23:01:23.771347Z","submitted_at":"2026-04-15T02:34:37Z","title":"The Cognitive Circuit Breaker: A Systems Engineering Framework for Intrinsic AI Reliability","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T13:56:05.550669Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.13417"},"observation_digest":"sha256:16672fa0b3c4578a24d2df050d5963e09acda334e0eb0c3c3e20f1d8ec7eea51","observation_id":"2ebbd697-b150-4a73-9a23-46b4d6672eb9","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.13694","last_updated":"2026-04-15T10:21:38Z","snapshot_observed_at":"2026-07-06T23:01:37.207817Z","submitted_at":"2026-04-15T10:21:38Z","title":"Weight Patching: Toward Source-Level Mechanistic Localization in LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T13:31:36.370422Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.13694"},"observation_digest":"sha256:e475fff69be37f20d045aef6ef7d5eec614580e1a5203bc42e3a1f035c6c685d","observation_id":"de151e43-9f2c-4ffd-b4e8-923961875a60","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.14434","last_updated":"2026-04-15T21:24:42Z","snapshot_observed_at":"2026-07-06T23:02:13.885476Z","submitted_at":"2026-04-15T21:24:42Z","title":"Geometric Routing Enables Causal Expert Control in Mixture of Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T12:53:48.734715Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.14434"},"observation_digest":"sha256:150e2f115dc205a14bbfc00fff72bdcc67e67aca1077bd50fde9cda2ab29f26a","observation_id":"43e10c68-cf43-486b-bf15-28e57de235ce","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.14463","last_updated":"2026-04-15T22:45:59Z","snapshot_observed_at":"2026-07-06T23:02:13.885476Z","submitted_at":"2026-04-15T22:45:59Z","title":"Psychological Steering of Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-10T12:44:46.997345Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.14463"},"observation_digest":"sha256:879f2514d29c75df7b866d1e9a4755f38418e821c0109cd1cef6618c8b541ceb","observation_id":"9a3a1d76-6b5f-4ac4-9192-5dd6360d0e91","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.14593","last_updated":"2026-04-22T09:12:17Z","snapshot_observed_at":"2026-07-30T07:10:47.674026Z","submitted_at":"2026-04-16T03:54:03Z","title":"Mechanistic Decoding of Cognitive Constructs in Large Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T12:13:25.350059Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.14593"},"observation_digest":"sha256:33302725e5d0828fee3edc0f18baaf4ade967bb2ee9686d6922faa0833d6018e","observation_id":"6a4b7f0e-eb79-44a2-9a73-12f5ea1a64f3","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.15400","last_updated":"2026-04-16T12:16:53Z","snapshot_observed_at":"2026-07-06T23:02:58.361418Z","submitted_at":"2026-04-16T12:16:53Z","title":"Hallucination as Trajectory Commitment: Causal Evidence for Asymmetric Attractor Dynamics in Transformer Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T11:02:21.049008Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.15400"},"observation_digest":"sha256:bdea1ba999963d9a5db267b9fa68ca29863bebaa8f1207d614dc32a5e11bc229","observation_id":"5d8926e8-ca78-4354-8e95-5ed73134ba16","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.15557","last_updated":"2026-04-16T22:18:59Z","snapshot_observed_at":"2026-07-06T23:03:02.938732Z","submitted_at":"2026-04-16T22:18:59Z","title":"Predicting Where Steering Vectors Succeed","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T10:59:30.755424Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.15557"},"observation_digest":"sha256:1ad03f5c30e05cfc0844516a2b4053147860755955af2e7c6d70def3070097a3","observation_id":"66628089-06b3-416f-8bcb-96aa793c02a5","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.17396","last_updated":"2026-04-19T11:59:58Z","snapshot_observed_at":"2026-07-06T23:04:32.734175Z","submitted_at":"2026-04-19T11:59:58Z","title":"Representation-Guided Parameter-Efficient LLM Unlearning","version":1},"reference_index":220,"source":"arxiv_source","source_observed_at":"2026-05-10T06:01:46.885030Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.17396"},"observation_digest":"sha256:5f850ed3dd7c644cc613611f60b262a95b86af46f9c3095ac84ebf45f313eeca","observation_id":"9c082272-1be1-4588-b6f7-dd7a60376495","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.17614","last_updated":"2026-04-19T20:58:25Z","snapshot_observed_at":"2026-07-06T23:04:41.564912Z","submitted_at":"2026-04-19T20:58:25Z","title":"Characterizing Model-Native Skills","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T05:42:49.694715Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.17614"},"observation_digest":"sha256:be76e5042434b65ed8c633fc5680dc80da1ca28a70c76fe55e4bec88fb150c51","observation_id":"cc261d1e-a70a-42bd-9c21-69c7a0e6cf6b","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.17691","last_updated":"2026-04-20T01:13:36Z","snapshot_observed_at":"2026-07-06T23:04:46.497227Z","submitted_at":"2026-04-20T01:13:36Z","title":"SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T05:23:15.746795Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.17691"},"observation_digest":"sha256:f1ad43ef20f63748e968462accb7999ba77827ef7571c6348f1b009c7845cebd","observation_id":"39231c5d-74c8-4e44-91c0-f54a8409ab28","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.18158","last_updated":"2026-04-20T12:22:15Z","snapshot_observed_at":"2026-07-31T11:35:00.280127Z","submitted_at":"2026-04-20T12:22:15Z","title":"State Transfer Reveals Reuse in Controlled Routing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T04:27:01.220899Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.18158"},"observation_digest":"sha256:7dbcd3edcd875c7a331a51f9394804f747d3fa3267e4724be8ed1147d20f9154","observation_id":"a6f3544b-6c7d-4296-803b-c6dbc7172063","resolution":{"observed_at":"2026-05-11T11:56:29.798826Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.18901","last_updated":"2026-05-09T11:13:19Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-20T23:02:37Z","title":"Harmful Intent as a Geometrically Recoverable Feature of LLM Residual Streams","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T04:34:24.866119Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.18901"},"observation_digest":"sha256:35f71f1132a27011016e210a3547484f784e7331f4b1bc4c6b31f1e5bc6b3ee5","observation_id":"8ab12e75-1eb4-4ca3-942a-7fb5d2f8b5d8","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.18901","last_updated":"2026-05-09T11:13:19Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-20T23:02:37Z","title":"Harmful Intent as a Geometrically Recoverable Feature of LLM Residual Streams","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T00:49:53.613850Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.18901"},"observation_digest":"sha256:9ec305a76251a5b536599b927ece8270a807be1ebf4af56f83ad87d6aadb9be2","observation_id":"bff81ab4-1b5a-4484-93fe-370205cf9b89","resolution":{"observed_at":"2026-05-12T00:51:15.525177Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.19018","last_updated":"2026-04-21T03:09:46Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:09:46Z","title":"Local Linearity of LLMs Enables Activation Steering via Model-Based Linear Optimal Control","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-10T02:31:07.932802Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.19018"},"observation_digest":"sha256:69442da7df6d90dbd7ca52144c5b918ad89989503fb957055431afa0af9fcbd4","observation_id":"d71f28f5-957f-4289-83f1-f95a078c91f9","resolution":{"observed_at":"2026-05-11T13:01:04.024089Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.19678","last_updated":"2026-06-23T10:58:57Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T16:56:55Z","title":"Exploring Language-Agnosticity in Function Vectors: A Case Study in Machine Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T02:49:55.908142Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.19678"},"observation_digest":"sha256:bd84a8db65fea137e5450977fd98f88d1f4e49284a8a3299b28f49da73c261a0","observation_id":"12ffeb8f-f367-42bc-824b-ecf8f7633cd1","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.20472","last_updated":"2026-04-22T11:58:05Z","snapshot_observed_at":"2026-07-06T23:06:55.880484Z","submitted_at":"2026-04-22T11:58:05Z","title":"Temporal Difference Calibration in Sequential Tasks: Application to Vision-Language-Action Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-09T23:59:32.295839Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.20472"},"observation_digest":"sha256:a1fad630c976d31aba0088c38427365bfc91da5ead0d11ed1312e5a70d617170","observation_id":"7b12bf95-859e-466b-b5a2-da06b12f5c35","resolution":{"observed_at":"2026-05-11T13:51:03.445109Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.24162","last_updated":"2026-04-27T08:18:30Z","snapshot_observed_at":"2026-07-06T23:10:16.426836Z","submitted_at":"2026-04-27T08:18:30Z","title":"Defusing the Trigger: Plug-and-Play Defense for Backdoored LLMs via Tail-Risk Intrinsic Geometric Smoothing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T03:09:43.879809Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.24162"},"observation_digest":"sha256:6aced66d9af4dbc7430f47a6c5b26a0cef1e51dfd34a49afbcd7a4f47a9d5d59","observation_id":"9178735e-93d7-4cf0-baf9-de55e92fc93e","resolution":{"observed_at":"2026-05-11T22:16:25.475395Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.24693","last_updated":"2026-04-27T16:54:16Z","snapshot_observed_at":"2026-07-06T23:10:42.926677Z","submitted_at":"2026-04-27T16:54:16Z","title":"Contextual Linear Activation Steering of Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T03:30:30.143805Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.24693"},"observation_digest":"sha256:0282546139f2867320e40496e63771f88c66da189a7e182f8f46dc283147c4fe","observation_id":"46e47c18-64ab-41a5-90b9-527975f3bab8","resolution":{"observed_at":"2026-05-11T22:06:13.591263Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.24801","last_updated":"2026-05-12T04:14:03Z","snapshot_observed_at":"2026-07-06T23:10:47.277692Z","submitted_at":"2026-04-27T02:39:02Z","title":"Architecture Determines Observability of Transformers","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-08T04:42:16.480831Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.24801"},"observation_digest":"sha256:53405a0880cd3f986e25f3a00c2d477b37e03ecca8856c117e9cac7a9bb1ee4b","observation_id":"7db145e6-1bd2-472a-aeb0-edecf94c4434","resolution":{"observed_at":"2026-05-11T21:36:18.413775Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.24801","last_updated":"2026-05-12T04:14:03Z","snapshot_observed_at":"2026-07-06T23:10:47.277692Z","submitted_at":"2026-04-27T02:39:02Z","title":"Architecture Determines Observability of Transformers","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:09.488225Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.24801"},"observation_digest":"sha256:51b1b023c3521e827f53b4922764911070c835a41ab7a03625f2a393e92f0818","observation_id":"134fbc5e-5576-4eda-ba27-bf4c1305da37","resolution":{"observed_at":"2026-05-13T07:32:29.229279Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.25783","last_updated":"2026-04-28T15:51:55Z","snapshot_observed_at":"2026-07-06T23:11:34.854305Z","submitted_at":"2026-04-28T15:51:55Z","title":"Subliminal Steering: Stronger Encoding of Hidden Signals","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-07T16:04:55.601088Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.25783"},"observation_digest":"sha256:85a15ee4df9cc7c491507cda49e5c8ab59eecc73432679aafc9b89bff45d7268","observation_id":"01c0fd95-92ca-49d5-9e57-56c9b8d4e1a1","resolution":{"observed_at":"2026-05-11T23:56:12.028836Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2604.27818","last_updated":"2026-04-30T12:58:57Z","snapshot_observed_at":"2026-07-06T23:13:15.994987Z","submitted_at":"2026-04-30T12:58:57Z","title":"MASCing: Configurable Mixture-of-Experts Behavior via Activation Steering Masks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-07T05:31:47.682478Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2604.27818"},"observation_digest":"sha256:4f354713a954fa4c390b0584bdd7cd14d733c9884845779c012fb6a7452fb697","observation_id":"833b6a49-59ca-493d-a3e8-a849dd50e73d","resolution":{"observed_at":"2026-05-12T10:36:30.178588Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00236","last_updated":"2026-04-30T21:15:38Z","snapshot_observed_at":"2026-07-06T23:13:42.661364Z","submitted_at":"2026-04-30T21:15:38Z","title":"Attention Is Where You Attack","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T19:54:41.445447Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00236"},"observation_digest":"sha256:79024c6828ad237f88fb9bfa88c00df34e0a56f9d72d0d4314579bc0509949ce","observation_id":"6bc14e0c-4106-4efd-b57d-ce0c45c02748","resolution":{"observed_at":"2026-05-11T15:31:05.133859Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00269","last_updated":"2026-04-30T22:06:02Z","snapshot_observed_at":"2026-07-06T23:13:42.661364Z","submitted_at":"2026-04-30T22:06:02Z","title":"How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-09T19:45:36.021741Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00269"},"observation_digest":"sha256:73901eb66053a376f16ec48aff2eaa36ce0d02552e912f6cadc9314a363afa3a","observation_id":"daa7d426-a515-4056-bd55-ebbbeb8666ed","resolution":{"observed_at":"2026-05-11T15:31:20.957306Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00435","last_updated":"2026-05-27T13:56:08Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T06:12:05Z","title":"Escaping Mode Collapse in LLM Generation via Geometric Regulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T19:17:42.182356Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00435"},"observation_digest":"sha256:1b098cec19c29584bface0e09f10a6dfc0384e60c36a49bc757fbd9e0433fd69","observation_id":"8dba1b73-bf40-4353-9ea8-1c7c8ad533ea","resolution":{"observed_at":"2026-05-11T15:46:40.402651Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00435","last_updated":"2026-05-27T13:56:08Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T06:12:05Z","title":"Escaping Mode Collapse in LLM Generation via Geometric Regulation","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-01T08:02:42.741391Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00435"},"observation_digest":"sha256:44c49a7ff2e923a56f3b53497583e614cb8a5a78e6db6c5535f9c17af3c545e6","observation_id":"b050556a-4f50-4973-a285-d929f3bfd2af","resolution":{"observed_at":"2026-07-01T08:05:30.553483Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00847","last_updated":"2026-05-06T20:35:10Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-04-15T00:59:17Z","title":"H-Probes: Extracting Hierarchical Structures From Latent Representations of Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T14:07:36.656164Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00847"},"observation_digest":"sha256:1cf96210ccfb357779ac9e98a1ea74e02e1ff043265541e8f08df023bee6fa14","observation_id":"13e6e8e2-7690-45e2-98cf-bc33a0cd8d83","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.00874","last_updated":"2026-04-25T01:01:02Z","snapshot_observed_at":"2026-07-30T23:55:12.391826Z","submitted_at":"2026-04-25T01:01:02Z","title":"Latent Space Probing for Adult Content Detection in Video Generative Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T21:07:18.808339Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.00874"},"observation_digest":"sha256:dd8978983ac313f8348127eead904366eb62279acbc65e814654e2400bf3502d","observation_id":"1c45c1ba-d450-49f4-9e5e-40d8325e778f","resolution":{"observed_at":"2026-05-11T14:46:10.886489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.01167","last_updated":"2026-05-01T23:52:54Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-01T23:52:54Z","title":"Minimizing Collateral Damage in Activation Steering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-09T18:58:30.056670Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.01167"},"observation_digest":"sha256:f5f5f92bf56ba1ae6e093be2ce6ef5b545a5bc8cf97d61ba50bd70db3353dedb","observation_id":"884d8a7d-5ef8-4bed-afc3-533a22390db1","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.01381","last_updated":"2026-05-02T11:08:10Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T11:08:10Z","title":"A framework for analyzing concept representations in neural models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T14:49:22.776209Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.01381"},"observation_digest":"sha256:76429ef0380e075d977a5e0c9fb0f97b4508a03b3a6f8bbd29842d623fba902d","observation_id":"3021057e-6592-4be4-94cf-7ada47ea6b3b","resolution":{"observed_at":"2026-05-11T16:51:06.982163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.01844","last_updated":"2026-06-04T12:53:36Z","snapshot_observed_at":"2026-07-06T23:15:01.968194Z","submitted_at":"2026-05-03T12:26:13Z","title":"The Cylindrical Representation Hypothesis for Language Model Steering","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T00:10:29.122196Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.01844"},"observation_digest":"sha256:7a60811aeb87842a3999fd14ed29ca83778287ca50219d324b2c21e093fb4982","observation_id":"12dfaaa3-b6b1-4b63-bfbf-5c7c671a4495","resolution":{"observed_at":"2026-07-01T00:15:09.263351Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.02236","last_updated":"2026-05-05T08:03:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T05:16:43Z","title":"Perturbation Dose Responses in Recursive LLM Loops: Raw Switching, Stochastic Floors, and Persistent Escape under Append, Replace, and Dialog Updates","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T19:17:06.375875Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.02236"},"observation_digest":"sha256:9e50d7d6994f0852be61f0510668d57fbc88ea1405144f7ed6a2defb69c45126","observation_id":"012db663-f289-46ed-8a92-6e07bb446206","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.02914","last_updated":"2026-04-08T05:27:33Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T05:27:33Z","title":"When Safety Geometry Collapses: Fine-Tuning Vulnerabilities in Agentic Guard Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T18:43:12.298529Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.02914"},"observation_digest":"sha256:000613f78cfcef427a168fcf26ee55b18a16d89c3c6d744010ff56857f34db6f","observation_id":"da824829-23a6-4e3f-814f-7171739e3393","resolution":{"observed_at":"2026-05-11T00:05:49.297190Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.02946","last_updated":"2026-05-01T11:54:55Z","snapshot_observed_at":"2026-07-31T02:35:59.178763Z","submitted_at":"2026-05-01T11:54:55Z","title":"RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-09T19:22:00.217729Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.02946"},"observation_digest":"sha256:a0f2a384560b75cc498c537741955674839531e639324ab9603f3256134639d4","observation_id":"d085cf60-44c3-45da-82e3-047cb77b2aef","resolution":{"observed_at":"2026-05-11T15:46:11.050355Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.03095","last_updated":"2026-05-04T19:17:50Z","snapshot_observed_at":"2026-07-06T23:16:05.372336Z","submitted_at":"2026-05-04T19:17:50Z","title":"Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-07T02:16:49.785596Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.03095"},"observation_digest":"sha256:de79304d4601355b2b8fdfe11ca7e13de1c7907e9dcd2353357ce6bc1a408037","observation_id":"e2f42eac-0d05-44d2-b670-7afe29546a4f","resolution":{"observed_at":"2026-05-12T10:46:31.258436Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.03160","last_updated":"2026-07-25T20:25:34Z","snapshot_observed_at":"2026-07-30T23:52:20.617659Z","submitted_at":"2026-05-04T21:11:21Z","title":"Steering grids for sparse-autoencoder features: when a top-context label names an activation regime rather than a causal axis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-07T02:21:50.008687Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.03160"},"observation_digest":"sha256:0056716309f9803b0421487a20dffcf4393706eea2f2bd909115b8ff0f0618f3","observation_id":"c22e0a68-d59b-4126-a838-a63cc2079621","resolution":{"observed_at":"2026-05-12T10:46:30.193230Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.03258","last_updated":"2026-05-15T12:19:58Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:13:06Z","title":"The Right Answer, the Wrong Direction: Why Transformers Fail at Counting and How to Fix It","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T17:53:24.057211Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.03258"},"observation_digest":"sha256:aa9bda5acc4940e89a080321f1c6ae91ed7707a929bb2f3b8f54882f9c8ce0bd","observation_id":"be1f7139-8e73-416a-9ac3-d303abf1eee3","resolution":{"observed_at":"2026-05-11T23:16:14.420457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.03258","last_updated":"2026-05-15T12:19:58Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:13:06Z","title":"The Right Answer, the Wrong Direction: Why Transformers Fail at Counting and How to Fix It","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T16:57:52.801399Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.03258"},"observation_digest":"sha256:13de58c9dd3423fe7475f93dd395bb23ad4de305335b5cb64ec26adf5df0034d","observation_id":"5bdf8f21-e5df-4d01-a2e1-88b4c48fa818","resolution":{"observed_at":"2026-05-19T17:02:40.947124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.03907","last_updated":"2026-05-05T15:59:42Z","snapshot_observed_at":"2026-07-06T23:16:44.876986Z","submitted_at":"2026-05-05T15:59:42Z","title":"Steer Like the LLM: Activation Steering that Mimics Prompting","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-07T16:20:10.078995Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.03907"},"observation_digest":"sha256:cb84b182d7eb75da5b0759d5e84bfb56071077f63ed56df19e7c3d4ab63cec0b","observation_id":"0295b8cd-b629-4c49-9868-6e34126261c9","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.05223","last_updated":"2026-04-18T05:53:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-18T05:53:31Z","title":"Structural Instability of Feature Composition","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T06:40:00.507484Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.05223"},"observation_digest":"sha256:16168901ca23aa998d095423e018c7aa6fd25c4c45f5866c48d193cd09813cc9","observation_id":"730b57e2-b0e4-4332-b199-aee6585e82bc","resolution":{"observed_at":"2026-05-10T18:11:41.052622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.05443","last_updated":"2026-05-08T18:19:21Z","snapshot_observed_at":"2026-07-06T23:18:02.987518Z","submitted_at":"2026-05-06T21:11:17Z","title":"SLAM: Structural Linguistic Activation Marking for Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T16:17:22.003460Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.05443"},"observation_digest":"sha256:cecca3a852660d70329a078c25cfd84ef7dfee7494f4c25bbf37c35181037c3b","observation_id":"f2e29597-86eb-4e23-83ac-e356fb62eb68","resolution":{"observed_at":"2026-05-11T18:21:06.940740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.05653","last_updated":"2026-05-07T04:09:11Z","snapshot_observed_at":"2026-07-06T23:18:12.631820Z","submitted_at":"2026-05-07T04:09:11Z","title":"Negative Before Positive: Asymmetric Valence Processing in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T11:13:15.576248Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.05653"},"observation_digest":"sha256:221bcfbc391002784c2adedb1884e7e5d1c1587aa98fc80588b1ff34764261bb","observation_id":"b211ae91-a9f5-4ac1-8868-7f556df831b2","resolution":{"observed_at":"2026-05-11T19:41:10.227342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.05687","last_updated":"2026-05-07T05:27:45Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:27:45Z","title":"DataDignity: Training Data Attribution for Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-08T11:53:19.594779Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.05687"},"observation_digest":"sha256:9e894e598d0ac47907a151bb797be34889936b12febcf2bcc64e6e5749acf5a9","observation_id":"d72c1cac-57e1-4406-bd62-3f26d5e67ac3","resolution":{"observed_at":"2026-05-11T19:26:10.316198Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":"2310.01405","doi":"10.1609/aaai.v36i9.21196","metadata_source":"pith","pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","venue":"cs.LG","work_id":"45b326e2-e962-41a5-a542-2559e103a19b","year":2023},"citing_paper":{"arxiv_id":"2605.05710","last_updated":"2026-05-07T05:55:10Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:55:10Z","title":"On the Blessing of Pre-training in Weak-to-Strong Generalization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-08T14:59:19.883399Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2605.05710"},"observation_digest":"sha256:b6fc76227bf551ce9b11c8efc628b47e73d918654362e12a646c4d84b263cb73","observation_id":"3c923213-ef65-42e3-a909-924b32ec3193","resolution":{"observed_at":"2026-05-11T18:36:08.753749Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.01405/citation-record","integrity":"/paper/2310.01405/integrity","json":"/paper/2310.01405/citation-record.json","paper":"/paper/2310.01405"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":"2005.14165","doi":"10.1145/1926385.1926423","metadata_source":"pith","pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Language Models are Few-Shot Learners","venue":"cs.CL","work_id":"214732c0-2edd-44a0-af9e-28184a2b8279","year":2020},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:ad28935510b731a091db4e84924a58af8cebb261fc45c180ba1e402587bbe3fb","observation_id":"34e1c715-38b8-4c2a-b10c-199cb9b6b92d","resolution":{"observed_at":"2026-05-10T18:11:40.992027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d17-1082","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:07:03.412321Z","title":"doi: 10.18653/v1/D17-1082","venue":null,"work_id":"4e65f57b-0562-4172-b6d3-b4ea2e5e62fb","year":2017},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:ddc41715a7fa07543fec9636f17200ca3f725cf1c9058e91fcb7cd07bb7119d6","observation_id":"c4953bea-638d-4984-a414-c8c11b18ccc2","resolution":{"observed_at":"2026-05-10T18:11:40.995924Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-13T23:49:40.495585+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T23:49:40.495585+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1421","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:58:32.284587Z","title":"doi: 10.18653/v1/n19-1421","venue":null,"work_id":"628930d3-897c-43a2-8d6d-589da959e066","year":2019},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:8a28114cd762d6fdea4ef1efbad3c69d99a8ea85701cc78c7c061a0ca65e0867","observation_id":"90ee26c9-7169-4f2f-b67f-481820211c1d","resolution":{"observed_at":"2026-05-10T18:11:40.999844Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-13T17:49:34.155783+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T17:49:34.155783+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Love” and “Hate","venue":null,"work_id":"f5e752d3-2a50-4639-9ddb-9ae231895eb1","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:8e8de53c991e83274e6d45c0d5d2b03dcaa0b4ed9056aac48588a0472be5dc21","observation_id":"897a3a8d-fcf7-490d-8585-7d424ea65e5a","resolution":{"observed_at":"2026-05-10T18:11:41.003358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We take the top PCA direction that explains the maximum variance in the data X D l","venue":null,"work_id":"54214e56-285d-4a16-ab35-a16cb4489760","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:3156f1e509166aa5b0264f502ca774b75bb60ca4f1b13cc07d339a2f36778d02","observation_id":"c543172b-36f0-472f-87a4-6b3d24a69235","resolution":{"observed_at":"2026-05-10T18:11:41.006338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We take the difference between the centroids of the two clusters as the concept direction","venue":null,"work_id":"7eb9c593-11d5-4815-80aa-1cf7e6e3545c","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:a518f970413d5c6810369549ac39e2d808b14aca1fdb4c2352309950d3bb8b63","observation_id":"cbe1f478-c849-4874-b4c2-04b03c9c59a7","resolution":{"observed_at":"2026-05-10T18:11:41.009220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"79d101df-2232-4ebc-b9e2-d3a37f400da6","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:1f765e1055dc1e721722766a24949abb40807e2eeb3491c4fb961d82d478d208","observation_id":"6e7a9a9a-c9ce-460c-bb82-a1c57dea0247","resolution":{"observed_at":"2026-05-10T18:11:41.011815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I made a mistake and copied my friend’s homework. I understand that it’s wrong and I take full responsibility for my actions","venue":null,"work_id":"96cf90c7-6aef-4deb-a837-0aac00ed302b","year":2018},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:7bc4372abc406f2eb2482de0a1299a6a84066347bdbbe3e51f311cc4f477031b","observation_id":"f10fe97c-1265-4fc8-90ad-913e52d61bec","resolution":{"observed_at":"2026-05-10T18:11:41.014706Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"psychopathic","venue":null,"work_id":"fdf91e20-0210-4ef4-a6f9-059269641ad3","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:f5914c6ce2e8057efc804c5d271d2ee3f68ea63d1df5b2fa71ed0b28cc0358a2","observation_id":"edfae63c-b5fa-46b1-94dd-f80069a50e8f","resolution":{"observed_at":"2026-05-10T18:11:41.017500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7edd6a89-e7a7-4d88-8105-d6b05330abb8","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:871aa3250988ee6f0f849072fa028730c3705a7af089b33673ff7d87a3011e2a","observation_id":"a333616f-b3f7-46fa-87c6-3c5ada89566d","resolution":{"observed_at":"2026-05-10T18:11:41.019986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"91fce8e3-bcef-42ac-9494-4588f8636138","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:e3b3d0b1b9fce782dcd0d24ab4c48515659f47c4001a022b6601b6c1b83a0269","observation_id":"01c27a0c-0562-439c-a4e6-57e5f76f7571","resolution":{"observed_at":"2026-05-10T18:11:41.022808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf14a3f6-8826-43b4-a728-481665d01c34","year":2023},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:814bfeef940d15a28fba7fb4ee79a242ba36551295314d4835458f76ef5b6ecc","observation_id":"68d291ee-1aec-4b21-a3dd-6f0518f16ed5","resolution":{"observed_at":"2026-05-10T18:11:41.025401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do the findings rest on strong theoretical assumptions; are they not demonstrated using leading-edge tasks or models; or are the findings highly sensitive to hyperparameters? □","venue":null,"work_id":"16de9035-9230-4a49-b148-26b3504c4169","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:15a15d41bba50e239ef29982ba3bdb4a048c2a2dd5de7862d73a60d5604e76f6","observation_id":"f418cdc6-15c3-461d-b8b8-02c15a24a597","resolution":{"observed_at":"2026-05-10T18:11:41.028176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is it implausible that any practical system could ever markedly outper- form humans at this task? □","venue":null,"work_id":"1be4a68a-4714-4658-a321-f0d676be6082","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:a56db73428fced26a20df009b72a6d71c19b9a67577126ff0428090ef745272d","observation_id":"8a662b95-5a9d-43fd-8961-d73b25588565","resolution":{"observed_at":"2026-05-10T18:11:41.030691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does this approach strongly depend on handcrafted features, expert supervision, or human reliability? □","venue":null,"work_id":"3c0b0eb4-a74d-40cd-893e-c720af877890","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:384a10be6de2b382f8e1e6a92d3e2d8fa4215a0527cc4206a47020374d148020","observation_id":"9f60eb8d-c717-45a4-bde5-47e66297f023","resolution":{"observed_at":"2026-05-10T18:11:41.033204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c75a7682-8c87-447a-b89c-0b78cfc6e3a9","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:5b4059cefb6a9d1df6c67aa74b6bb2f7ac14b7626121620e00f1ae0ee31b7714","observation_id":"c6a435fd-2828-44fa-a69f-6442515ab9f2","resolution":{"observed_at":"2026-05-10T18:11:41.035435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How does this improve safety more than it improves general capabilities? Answer: This work mainly improves transparency and control","venue":null,"work_id":"3f585b6d-f92b-4c1e-b22a-3d7149588a6d","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:b74c05fb356d9bd3bd15ed8b6776733d53169872b6498bf1d93de786e0de286a","observation_id":"24b981ee-bce1-4524-844b-965e08d46b4e","resolution":{"observed_at":"2026-05-10T18:11:41.037925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6f07fe96-ab63-4377-b00c-7ed7c69a5b93","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:a1c1ed4b9cd129b6e774f7e887014e2f5453554c64a02c74ae6df41740466b3d","observation_id":"84ff59e6-00d6-4ca0-93bc-eed2f3dbe05f","resolution":{"observed_at":"2026-05-10T18:11:41.040111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does this work advance progress on tasks that have been previously considered the subject of usual capabilities research? □","venue":null,"work_id":"97dd2ef3-2a89-4af3-9398-ef82754f1585","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:7f07f8da3699260dad0f3b4788ac2e72b13deb70cd8732f096a1f2043d392d7c","observation_id":"273778c6-aadf-4923-8a35-46119b923b53","resolution":{"observed_at":"2026-05-10T18:11:41.042466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"01007804-9dc7-47d7-83e2-46ae6e145d41","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:3bb8ea69debd19cc2081717fda2f91e3e2109da96dccf395523a17498cfd46bb","observation_id":"84f757df-78ba-4bbd-9e82-206b2dd2d0dc","resolution":{"observed_at":"2026-05-10T18:11:41.044790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"055e9e25-9ac8-4212-b6ed-e8303466d25e","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:873d60858fb27fec8d93a9bde46aa0a7dd203543c3d858e98c4cdae1a2a7248b","observation_id":"74e244a9-be65-4193-b51d-deb26d4fc3c3","resolution":{"observed_at":"2026-05-10T18:11:41.046954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Does this advance safety along with, or as a consequence of, advancing other capabilities or the study of AI? □ E.3 E LABORATIONS AND OTHER CONSIDERATIONS","venue":null,"work_id":"6c8d8a40-e954-47e9-94b4-5bc441ffe7ff","year":null},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:9144606f983cacec06462c069f0e3efd9ef1f72f56f8a7ca5e6edbe0398b4276","observation_id":"b091299d-93f6-4c2f-b2c7-dff173ec1c55","resolution":{"observed_at":"2026-05-10T18:11:41.049442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"complex and fragile","venue":null,"work_id":"a0d5322c-3e18-449d-bf8c-a2df03c56505","year":2023},"citing_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T18:11:40.970904Z"},"links":{"citing_paper":"/paper/2310.01405"},"observation_digest":"sha256:c07d6464989926f90c5b1cc4b993c56d391851a7b842c804a3520ec36300f658","observation_id":"61f2fb19-62ef-440f-90e4-2231b7923c0f","resolution":{"observed_at":"2026-05-10T18:11:41.051802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":2,"verified_fuzzy":11},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"thesis":"As of 31 July 2026, this Paper Citation Record lists 23 of 23 outbound references and 100 inbound Pith citation observations for arXiv:2310.01405."}