{"as_of":"2026-08-12T05:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6eed5174133e7aadf4482a3ed68762862f83b34c3041182528ceccd9cd533610","coverage":[{"denominator":99,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":99,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:17:56.224644Z","state":"measured"},{"denominator":99,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":99,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09928/citation-record","integrity":"/paper/2608.09928/integrity","json":"/paper/2608.09928/citation-record.json","paper":"/paper/2608.09928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.734741Z","title":"Pixtral 12b: A new frontier in image and text understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.734741Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:805af9cadc5f3233c668bf48b405dd39867d8d0df656d6c413faf13a7505ecc2","observation_id":"63a68806-aeda-41aa-8974-f329e2ebba67","resolution":{"observed_at":"2026-08-11T04:17:55.734741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.740439Z","title":"Golden gate Claude","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.740439Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:fc42c1e1bff6ee0c8263d8bf6c563b28ee6289af69d1182e66d025893ff12358","observation_id":"e980897a-63ad-4ab4-9cae-ab1bace9e2e9","resolution":{"observed_at":"2026-08-11T04:17:55.740439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.744964Z","title":"SAE on activation differences","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.744964Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:c0810ef6b85f511601cbcf282988ccbbf9a36fa6e5a807d0326b924ae57bf96b","observation_id":"b478f42b-d307-42c5-b16b-5954735aa5a1","resolution":{"observed_at":"2026-08-11T04:17:55.744964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-08-11T04:17:55.749442Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.749442Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:577b531bbf1c68e6f617dd52bd3663e476548bb4fbe913c529d404287d9414b9","observation_id":"eed6e3f5-9874-4c87-b480-11f0d9fdb4ad","resolution":{"observed_at":"2026-08-11T04:17:55.749442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.754302Z","title":"Revisiting model stitching to compare neural representations.Advances in neural information processing systems, 34:225–236, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.754302Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:70ddf7a989e9205921cd642e44f94c546c2f65adfe3c1ac520c1de2d9107c2b5","observation_id":"15f9a23f-fb05-4140-b13b-89fcd2bd4712","resolution":{"observed_at":"2026-08-11T04:17:55.754302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.00058","last_updated":"2022-06-28T22:35:25Z","snapshot_observed_at":"2026-08-11T16:49:09.832542Z","submitted_at":"2021-12-31T21:08:56Z","title":"Representation Topology Divergence: A Method for Comparing Neural Network Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.00058","snapshot_observed_at":"2026-08-11T04:17:55.758852Z","title":"Representation topology divergence: A method for comparing neural network representations.arXiv preprint arXiv:2201.00058, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.758852Z"},"links":{"cited_paper":"/paper/2201.00058","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:87e9ca6c2b66ecc5555fe71af8aa57fbb535edeabae88f5f69409b53df2efad9","observation_id":"99bad67a-8f11-4798-a8d3-1e4ee9868bcc","resolution":{"observed_at":"2026-08-11T04:17:55.758852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.764254Z","title":"Understanding information storage and transfer in multi-modal large language models.Advances in Neural Information Processing Systems, 37:7400–7426, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.764254Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:6a889169c7b30ffe5c2683ed1011d65bd6a1d9e72637a5f7b81769d48ea13edd","observation_id":"fb3300c3-6ac8-4870-bef9-0d7a1e819f96","resolution":{"observed_at":"2026-08-11T04:17:55.764254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.768697Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning.Transformer Circuits Thread, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.768697Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:24531705af0088afb31857b117fef3871b6efa190bc1a79643e25de9e6063e6f","observation_id":"775b35d7-5787-42c1-b28c-727175dec30e","resolution":{"observed_at":"2026-08-11T04:17:55.768697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.773486Z","title":"Stage-wise model diffing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.773486Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:f7d24fb26f610ae83c3723088465ff752b465bea2a696b30875238aae3d3f2d6","observation_id":"bfb2af8f-ac38-41fa-a848-228a761cca3a","resolution":{"observed_at":"2026-08-11T04:17:55.773486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.778192Z","title":"Observing and controlling features in vision-language-action models.arXiv preprint arXiv:2603.05487, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.778192Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:ad34425c805add49687ca615e800acedb18a038d82014dfcd9b2802bbfaf99e3","observation_id":"96afae2d-fab5-435d-bf48-229175c2211e","resolution":{"observed_at":"2026-08-11T04:17:55.778192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02193","last_updated":"2024-11-21T12:10:54Z","snapshot_observed_at":"2026-08-11T21:14:56.304779Z","submitted_at":"2024-11-04T15:46:20Z","title":"Improving Steering Vectors by Targeting Sparse Autoencoder Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02193","snapshot_observed_at":"2026-08-11T04:17:55.782849Z","title":"Improving steering vectors by targeting sparse autoencoder features.arXiv preprint arXiv:2411.02193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.782849Z"},"links":{"cited_paper":"/paper/2411.02193","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:23a3ac36045ee3199918b1bde37e6ac91f7285ee81b5b82f978580c0e4830401","observation_id":"bae5706b-c4c3-4713-829f-3cfd8479df19","resolution":{"observed_at":"2026-08-11T04:17:55.782849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.788114Z","title":"Pappas, Florian Tramer, Hamed Hassani, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.788114Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:c2efb92584ec8a5d6f52c7b4e81de5f914c3583edbd489340b87e5c2254cd864","observation_id":"21aef9b8-39d4-4a4a-bb5e-514a373a0a0d","resolution":{"observed_at":"2026-08-11T04:17:55.788114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10591","last_updated":"2023-10-16T17:12:06Z","snapshot_observed_at":"2026-08-12T03:17:14.272491Z","submitted_at":"2023-10-16T17:12:06Z","title":"Interpreting and Controlling Vision Foundation Models via Text Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10591","snapshot_observed_at":"2026-08-11T04:17:55.793237Z","title":"Interpreting and controlling vision foundation models via text explanations.arXiv preprint arXiv:2310.10591, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.793237Z"},"links":{"cited_paper":"/paper/2310.10591","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:df44a53a001377e3f49d125dd9974ce91091340c283c8505265d725cb90c885d","observation_id":"943068ae-9db0-4d97-a492-eea47ed36f53","resolution":{"observed_at":"2026-08-11T04:17:55.793237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15621","last_updated":"2025-07-31T12:41:25Z","snapshot_observed_at":"2026-08-07T16:50:53.680156Z","submitted_at":"2025-03-19T18:10:12Z","title":"LLaVA-MORE: A Comparative Study of LLMs and Visual Backbones for Enhanced Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15621","snapshot_observed_at":"2026-08-11T04:17:55.798668Z","title":"Llava-more: A comparative study of llms and visual backbones for enhanced visual instruction tuning.arXiv preprint arXiv:2503.15621, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.798668Z"},"links":{"cited_paper":"/paper/2503.15621","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:72fc1c4beaf7de23a35d724719a33ee22b65d0d877f213f007dade7ded3297eb","observation_id":"729e283c-fe58-406d-a371-03d8e94288e4","resolution":{"observed_at":"2026-08-11T04:17:55.798668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18512","last_updated":"2025-07-24T15:33:31Z","snapshot_observed_at":"2026-08-06T14:30:07.130911Z","submitted_at":"2025-07-24T15:33:31Z","title":"Explaining How Visual, Textual and Multimodal Encoders Share Concepts","version":1},"cited_work":{"arxiv_id":"2507.18512","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.18512","snapshot_observed_at":"2026-08-11T04:17:57.277219Z","title":"Explaining How Visual, Textual and Multimodal Encoders Share Concepts","venue":"cs.CV","work_id":"e5fb4660-8952-4520-8d20-bd1557f34584","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.803988Z"},"links":{"cited_paper":"/paper/2507.18512","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:426f4d0eb2bff07da9876238e00c9d8aaf1f2599588cc9681d14b52bd7f55a40","observation_id":"47c9ed4e-1705-4432-9bf6-b809e4061e02","resolution":{"observed_at":"2026-08-11T04:17:57.283192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-11T07:21:14.568175Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-11T04:17:55.809262Z","title":"Sparse autoen- coders find highly interpretable features in language models.arXiv preprint arXiv:2309.08600, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.809262Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:3267374d6a1d5866bce4c5533a614ece4eb35bd7f12a575fc83bb90bae6f09a6","observation_id":"9ea49434-9b1f-4ea9-b45e-0b22dc3bbf00","resolution":{"observed_at":"2026-08-11T04:17:55.809262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.814349Z","title":"Case study: Interpreting, manipulating, and controlling CLIP with sparse autoencoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.814349Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:687e2dadccca39c0aff04e5c9b057bfd4ff8f3b9b0fde2e98861938f1960d181","observation_id":"ef347515-df97-4217-990c-bac9c5c5f962","resolution":{"observed_at":"2026-08-11T04:17:55.814349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-11T04:17:55.819230Z","title":"Toy models of superposition, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.819230Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d660b2037d25fdde015592850206d7de5609757f2cae9b5ca93d659c18325a89","observation_id":"c03b7f1f-509a-432a-bf1a-565eab037242","resolution":{"observed_at":"2026-08-11T04:17:55.819230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.824530Z","title":"Why does unsupervised pre-training help deep learning? 11:625–660, March","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.824530Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:e85cc7ae976c41b3210d78012dcbf05fe9d4e461006969a7106fe5bdee441fff","observation_id":"907a2509-8501-4d4e-b1ce-4313ef05a681","resolution":{"observed_at":"2026-08-11T04:17:55.824530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05916","last_updated":"2024-03-29T03:40:47Z","snapshot_observed_at":"2026-08-09T16:06:08.831990Z","submitted_at":"2023-10-09T17:59:04Z","title":"Interpreting CLIP's Image Representation via Text-Based Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05916","snapshot_observed_at":"2026-08-11T04:17:55.829626Z","title":"Interpreting clip’s image representa- tion via text-based decomposition.arXiv preprint arXiv:2310.05916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.829626Z"},"links":{"cited_paper":"/paper/2310.05916","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:3a5865c3f5e6c694ff4b3eead4d16504296e59837a3253f5365fbf18c7c24f75","observation_id":"5dc90ba2-6e4d-4bbf-98b4-ace19979d697","resolution":{"observed_at":"2026-08-11T04:17:55.829626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04093","last_updated":"2024-06-06T14:10:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-06T14:10:12Z","title":"Scaling and evaluating sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04093","snapshot_observed_at":"2026-08-11T04:17:55.834643Z","title":"Scaling and evaluating sparse autoencoders.arXiv preprint arXiv:2406.04093, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.834643Z"},"links":{"cited_paper":"/paper/2406.04093","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d9869e79862e0f350b8146ac43fdf6725a217f7c8e842188a097423ecd8cc6d7","observation_id":"4227ee35-1ef9-4683-9e9f-b03e81994704","resolution":{"observed_at":"2026-08-11T04:17:55.834643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-11T04:17:55.839825Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.839825Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:53941cef8d9c26bed9946ed77ed158da40362c5dd8822c9fc282f940d5813482","observation_id":"a67d0a03-cb2c-48bc-99b6-5077d2ca94a8","resolution":{"observed_at":"2026-08-11T04:17:55.839825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.845475Z","title":"FigStep: Jailbreaking large vision-language models via typographic visual prompts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.845475Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:66f7e08baa6ce8f859abadee8373c5274f816e014da3aa79b2c94cdafbe9f884","observation_id":"2891bc5a-3300-4926-b5a2-2e673fc4e1d2","resolution":{"observed_at":"2026-08-11T04:17:55.845475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.850637Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.850637Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:7a2c401b68c4b7a52303dc3bcdd4fcf608a921340fafe43f9f866b59c58ced57","observation_id":"eb7628dc-8244-471c-97d8-776e74cf4700","resolution":{"observed_at":"2026-08-11T04:17:55.850637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.856252Z","title":"Not all features are created equal: A mechanistic study of vision-language-action models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.856252Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:0810929078b3ccbe22efe3d166d43b732c7fc95091e453ceddd351c5968ff23a","observation_id":"383f8bd4-0f3d-4f1e-8663-f5c8552e8985","resolution":{"observed_at":"2026-08-11T04:17:55.856252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T04:17:55.861229Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.861229Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:b00e653ff5c46cc6fe5a598aac7c83da5f7e13f520d3eb7c45a9acda5b1d2bc4","observation_id":"594550ea-48d5-4b18-a375-73064b1a6c2e","resolution":{"observed_at":"2026-08-11T04:17:55.861229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00328","last_updated":"2025-08-30T03:01:57Z","snapshot_observed_at":"2026-08-09T01:42:33.969493Z","submitted_at":"2025-08-30T03:01:57Z","title":"Mechanistic interpretability for steering vision-language-action models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00328","snapshot_observed_at":"2026-08-11T04:17:55.865869Z","title":"Mechanistic interpretability for steering vision-language-action models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.865869Z"},"links":{"cited_paper":"/paper/2509.00328","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:64a1023a2ce4b27796fd81d3aef14d2a670f690b1dfa25363ebc34967a68c2f5","observation_id":"51b802d7-af4b-4cde-979e-97fc6d7c7e49","resolution":{"observed_at":"2026-08-11T04:17:55.865869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20526","last_updated":"2024-10-27T17:33:49Z","snapshot_observed_at":"2026-08-10T11:13:13.559357Z","submitted_at":"2024-10-27T17:33:49Z","title":"Llama Scope: Extracting Millions of Features from Llama-3.1-8B with Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20526","snapshot_observed_at":"2026-08-11T04:17:55.870806Z","title":"Llama scope: Extracting millions of features from llama-3.1-8b with sparse autoencoders.arXiv preprint arXiv:2410.20526, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.870806Z"},"links":{"cited_paper":"/paper/2410.20526","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:0c7a15637354883232810264730c67a9c58a2db60f6cb8a6cbb20ec3d009baa2","observation_id":"3b640386-0590-4017-8b10-8dcab1ed9d2b","resolution":{"observed_at":"2026-08-11T04:17:55.870806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.875585Z","title":"In-context learning creates task vectors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.875585Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:f24e33aa42c7eb6d9a0d7d2716d9e673b83f9f443b76677e81ef5441f8556718","observation_id":"e94666bd-7d15-4980-b0a4-2c789fe46bb3","resolution":{"observed_at":"2026-08-11T04:17:55.875585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19939","last_updated":"2025-05-17T15:14:14Z","snapshot_observed_at":"2026-08-12T05:37:42.791687Z","submitted_at":"2024-11-29T18:56:37Z","title":"VLSBench: Unveiling Visual Leakage in Multimodal Safety","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19939","snapshot_observed_at":"2026-08-11T04:17:55.880064Z","title":"VLSBench: Unveiling visual leakage in multimodal safety.arXiv preprint arXiv:2411.19939, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.880064Z"},"links":{"cited_paper":"/paper/2411.19939","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:24c9e2df2dfe16e021068cac8bce7bf8756eeb1f0025b60b669ee5ca71e51252","observation_id":"ed622c66-b2d4-4498-8016-67dc19488d7e","resolution":{"observed_at":"2026-08-11T04:17:55.880064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-08-11T04:17:55.885168Z","title":"Sleeper agents: Training deceptive llms that persist through safety training.arXiv preprint arXiv:2401.05566, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.885168Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:35818692f8790a7a3e2a36dbcc754eb861451ba6a23734116ecb901973b178c3","observation_id":"92e3a5d3-924f-4d22-961c-de23b2368db0","resolution":{"observed_at":"2026-08-11T04:17:55.885168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02762","last_updated":"2025-02-10T20:13:31Z","snapshot_observed_at":"2026-08-09T16:06:26.088504Z","submitted_at":"2024-10-03T17:59:57Z","title":"Interpreting and Editing Vision-Language Representations to Mitigate Hallucinations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02762","snapshot_observed_at":"2026-08-11T04:17:55.889674Z","title":"Interpreting and editing vision-language representations to mitigate hallucinations.arXiv preprint arXiv:2410.02762, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.889674Z"},"links":{"cited_paper":"/paper/2410.02762","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:dfab4af318d9c5ed0faaa8a78116090de49bdfd574c9b5645a873e407b609bcd","observation_id":"60bfe481-7159-4238-b912-6accdf089da1","resolution":{"observed_at":"2026-08-11T04:17:55.889674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.894475Z","title":"A “diff” tool for AI: Finding behavioral differences in new models","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.894475Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:3fd8ab729225c38a359e6c41a4b6da325459725afaab237ead18dca8c33adb68","observation_id":"dd219166-8d27-475a-a1c4-06ce11c66684","resolution":{"observed_at":"2026-08-11T04:17:55.894475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.900408Z","title":"Bridging the VLM and mech interp communities for multimodal interpretability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.900408Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:e352ea5e31e4d00d4b498a10238fe9413fb175d93e8ce4ea1798ad627375aa96","observation_id":"7bdee4c9-2165-49f5-a2c8-8a114e2a8644","resolution":{"observed_at":"2026-08-11T04:17:55.900408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08729","last_updated":"2025-04-11T17:56:09Z","snapshot_observed_at":"2026-08-07T16:06:27.536555Z","submitted_at":"2025-04-11T17:56:09Z","title":"Steering CLIP's vision transformer with sparse autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08729","snapshot_observed_at":"2026-08-11T04:17:55.905911Z","title":"Steering CLIP’s vision transformer with sparse autoencoders.arXiv preprint arXiv:2504.08729, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.905911Z"},"links":{"cited_paper":"/paper/2504.08729","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:46419cf71e8949e0476291584f621fb27138b212ef4a526ce83cbae21221dd60","observation_id":"0a1b3935-db61-4b7d-b663-d9f6cdf18b9d","resolution":{"observed_at":"2026-08-11T04:17:55.905911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19475","last_updated":"2025-06-03T06:43:53Z","snapshot_observed_at":"2026-08-08T06:14:47.169680Z","submitted_at":"2025-04-28T04:31:24Z","title":"Prisma: An Open Source Toolkit for Mechanistic Interpretability in Vision and Video","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19475","snapshot_observed_at":"2026-08-11T04:17:55.911157Z","title":"Prisma: An open source toolkit for mechanistic interpretability in vision and video","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.911157Z"},"links":{"cited_paper":"/paper/2504.19475","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:7650e790b9bcde62d92431fedc03604e4ffa11ffd2249dfe0e234ddf29b523a5","observation_id":"02d7cbe7-c662-4f20-a2f1-8f252dca6f28","resolution":{"observed_at":"2026-08-11T04:17:55.911157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03012","last_updated":"2025-08-13T13:42:57Z","snapshot_observed_at":"2026-08-11T03:14:04.497536Z","submitted_at":"2025-01-06T13:37:13Z","title":"Analyzing Finetuning Representation Shift for Multimodal LLMs Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03012","snapshot_observed_at":"2026-08-11T04:17:55.916191Z","title":"Analyzing fine-tuning representation shift for multimodal llms steering alignment.arXiv preprint arXiv:2501.03012, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.916191Z"},"links":{"cited_paper":"/paper/2501.03012","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d7ee6fc2876015e0ed36555d725526e0a6980dcbaab6fab464fe19a766381020","observation_id":"4e56b9bf-2caf-4a64-8b63-4fffadd4fa48","resolution":{"observed_at":"2026-08-11T04:17:55.916191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.921070Z","title":"Saes (usually) transfer between base and chat models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.921070Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:cb16ffa21301a1ee65e2426975b62713804ec1ce76262b5814f6aeaef367b9b5","observation_id":"bb729be5-e31f-4c6f-95d7-d9726ae0138e","resolution":{"observed_at":"2026-08-11T04:17:55.921070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.926358Z","title":"Similarity of neural network representations revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.926358Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:4219c7c5438771ca1871cb20e80a96383cd299ceefe27eac9b66df92531b2f2b","observation_id":"16f919f1-5867-4ed1-b1a8-49dea9800dbf","resolution":{"observed_at":"2026-08-11T04:17:55.926358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.931559Z","title":"Sakla, and Kowshik Thopalli","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.931559Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:9bcb6f9308fc310d6730b35bbfe5069970a8423fba945ec21ea8454edb1c6ad6","observation_id":"07a5bec2-b757-4592-8d0b-4eccf85b6d89","resolution":{"observed_at":"2026-08-11T04:17:55.931559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.936739Z","title":"Understanding image representations by measuring their equivariance and equivalence","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.936739Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:6fabe5c9e59604b6b9600833665c501321c95ccdd0647aacad81e39ec753af0a","observation_id":"62157067-b288-4ad7-97cb-c5b4e1633c98","resolution":{"observed_at":"2026-08-11T04:17:55.936739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-07-06T18:44:24.873040Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-11T04:17:55.941614Z","title":"Llava-next-interleave: Tackling multi-image, video, and 3d in large multimodal models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.941614Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:e5db026272fda0cc7b9b188fb2df604d6b9933cc7aefe97fd858837582a80f6f","observation_id":"ef4f6fd3-9c05-4ffc-8be7-8a071882afe6","resolution":{"observed_at":"2026-08-11T04:17:55.941614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.946783Z","title":"Inference- time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.946783Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:a0a702b39b2962c9d5daaa07f7d1b7e59713b919252cd75a06dfe1711b8ffdea","observation_id":"ae34dab8-af93-4449-8e3a-061503ffd727","resolution":{"observed_at":"2026-08-11T04:17:55.946783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.964116Z","title":"Images are Achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models","venue":null,"work_id":"fb10721f-f0eb-4d5e-8519-2eed00403bb9","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.951510Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:58dafad7b4338b6e0431f19c5cc1440a84a617389ccaea593c605e9d55ef89de","observation_id":"f66078d7-2322-48be-8ac4-5c1c808c4191","resolution":{"observed_at":"2026-08-11T04:17:57.969271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07543","last_updated":"2016-02-28T22:04:54Z","snapshot_observed_at":"2026-08-03T16:55:19.885866Z","submitted_at":"2015-11-24T02:31:46Z","title":"Convergent Learning: Do different neural networks learn the same representations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07543","snapshot_observed_at":"2026-08-11T04:17:55.956223Z","title":"Convergent learning: Do different neural networks learn the same representations?arXiv preprint arXiv:1511.07543, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.956223Z"},"links":{"cited_paper":"/paper/1511.07543","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:38e5e5a02d9d819de84ee1922a96788580ea25a52f977b7e22f6e598d2612e86","observation_id":"7c5cf49e-69d0-46fc-b00c-d062e287ae2c","resolution":{"observed_at":"2026-08-11T04:17:55.956223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-11T23:41:02.350987Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-11T04:17:55.961255Z","title":"Gemma Scope: Open sparse autoencoders everywhere all at once on Gemma 2.arXiv preprint arXiv:2408.05147, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.961255Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:65b18c2aefae9bf4a4d3270cecf5c0feb9e359477c296dffaab05503242bda6b","observation_id":"b362ad44-4a2b-4a9d-9394-b8618f4cc42d","resolution":{"observed_at":"2026-08-11T04:17:55.961255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05276","last_updated":"2025-03-21T13:02:14Z","snapshot_observed_at":"2026-08-11T20:46:45.540438Z","submitted_at":"2024-12-06T18:59:51Z","title":"Sparse autoencoders reveal selective remapping of visual concepts during adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05276","snapshot_observed_at":"2026-08-11T04:17:55.967019Z","title":"Sparse autoencoders reveal selective remapping of visual concepts during adaptation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.967019Z"},"links":{"cited_paper":"/paper/2412.05276","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d72aaea12f496994cc5490917bac4b465e29cd4f5f9d480b8677d54e704bc29f","observation_id":"f5eddaa7-8d8b-40f1-9231-425afcca5f9e","resolution":{"observed_at":"2026-08-11T04:17:55.967019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17516","last_updated":"2025-02-22T20:55:26Z","snapshot_observed_at":"2026-08-11T23:52:20.797151Z","submitted_at":"2025-02-22T20:55:26Z","title":"A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17516","snapshot_observed_at":"2026-08-11T04:17:55.972218Z","title":"A survey on mecha- nistic interpretability for multi-modal foundation models.arXiv preprint arXiv:2502.17516, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.972218Z"},"links":{"cited_paper":"/paper/2502.17516","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:3610c231bc38041e6606a4a1e8e0c4bca39312fd164454d9acb4895c7300ef3d","observation_id":"74cb08c5-3e38-4f66-b5a3-cf3e6d9061f1","resolution":{"observed_at":"2026-08-11T04:17:55.972218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.946780Z","title":"Sparse crosscoders for cross-layer features and model diffing, October 25 2024","venue":null,"work_id":"f5b94ef0-da8d-4b4a-aca8-72e7272b2ef6","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.977277Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:aa3847699430106ce8b44032325eee3d85be614a656bc0918feaae19c83c49c5","observation_id":"50c39459-8359-4d8a-8f3b-06a5764fccdb","resolution":{"observed_at":"2026-08-11T04:17:57.952495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.928716Z","title":"Visual spatial reasoning.Transactions of the Association for Computational Linguistics, 2023","venue":null,"work_id":"0e18a0d1-d6af-4c8f-a589-46e25f093be4","year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.981926Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:26cbb3a1116d018bc28c77b199737bbfa5d13c677bf13fd49dcfaba66dd9c3a2","observation_id":"e242e417-d6d1-466c-8c67-75d87eb17f48","resolution":{"observed_at":"2026-08-11T04:17:57.934987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.986160Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.986160Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d44e69dc4952fbdc42657174c944d17843abaf4d7af11ab2918081046ccaa94b","observation_id":"428d81df-84f7-4297-95c6-84ba78dfca31","resolution":{"observed_at":"2026-08-11T04:17:55.986160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:55.990284Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.990284Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:66830b2123b94ac0b7f10c0cf2a03b8a4a5be668712b37cf0e338bc5976d1c0c","observation_id":"159ce224-eb30-4005-bd03-3e7034b33e31","resolution":{"observed_at":"2026-08-11T04:17:55.990284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.891978Z","title":"MM-SafetyBench: A benchmark for safety evaluation of multimodal large language models","venue":null,"work_id":"bf28f7cf-41f1-4aa2-814c-afa38f63bfb7","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.994689Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:1d5ec6c887008bba68d02aa27628b97e4d0d0289b37656f705a79c1bf283182a","observation_id":"a8f7a635-04af-41c1-9058-446d263e58fb","resolution":{"observed_at":"2026-08-11T04:17:57.897139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07895","last_updated":"2024-08-26T02:37:14Z","snapshot_observed_at":"2026-07-06T15:26:46.489500Z","submitted_at":"2023-05-13T11:28:37Z","title":"OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07895","snapshot_observed_at":"2026-08-11T04:17:55.999133Z","title":"OCRBench: On the hidden mystery of OCR in large multimodal models.Science China Information Sciences, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:55.999133Z"},"links":{"cited_paper":"/paper/2305.07895","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:4f01d484f1b453fa927f433435c8edd252fa01c49661ef6e90c13796160f67e9","observation_id":"4cc32df0-f6f3-4a06-9080-8ad98d0fa6c4","resolution":{"observed_at":"2026-08-11T04:17:55.999133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.874868Z","title":"Michaud, Yonatan Belinkov, David Bau, and Aaron Mueller","venue":null,"work_id":"ed906814-f056-4469-832c-6bf3d9bcc38d","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.003768Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:892ac46119224ed648d5890170c3b1c1f175e8afe0c5a38abb9e58b1c86ca185","observation_id":"2db28554-8e14-41be-8bc8-fc9bd7333573","resolution":{"observed_at":"2026-08-11T04:17:57.880397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.008128Z","title":"Locating and editing factual associations in GPT","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.008128Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:9f0104f8a4e9b5bdd4e5f057449c74ed3f11a595d21f8e2bb5a1541fbfee8ac0","observation_id":"1012ade3-0d1d-4240-a17c-094795998f39","resolution":{"observed_at":"2026-08-11T04:17:56.008128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.012960Z","title":"Robustly identifying concepts introduced during chat fine-tuning using crosscoders.arXiv preprint arXiv:2504.02922, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.012960Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:e123e99b349617d9548a537fc6fd7c8a140065ed51cfe75b126ef81ffcf0af91","observation_id":"464d7b55-d456-457f-86c9-7b103017259e","resolution":{"observed_at":"2026-08-11T04:17:56.012960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.847979Z","title":"What we learned trying to diff base and chat models (and why it matters).LessWrong, 2025","venue":null,"work_id":"ad227817-cda2-4294-8440-803ea87d3bad","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.017719Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:059a810da2fb55acbaca2d03657a78bdc5023f513b68e31803551d94bb75c546","observation_id":"cc5bc455-3eba-42e8-901f-b572d332ca4a","resolution":{"observed_at":"2026-08-11T04:17:57.853986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.831102Z","title":"Insights on crosscoder model diffing","venue":null,"work_id":"5211a430-248a-466a-8763-4f5633ab776d","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.022501Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:77d03b70068b316ac11a3dee6644627a7be5e1b00092e4c061ba946d306351e4","observation_id":"8451658b-066d-4558-848c-483cfff8b398","resolution":{"observed_at":"2026-08-11T04:17:57.837250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.811618Z","title":"Attribution patching: Activation patching at industrial scale","venue":null,"work_id":"2da96e75-91a7-44c3-a567-684104521d73","year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.027425Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:d41d7e9501306db808973dee37848ee4a84fdb17d7d832989b63fd23afb48c2a","observation_id":"5db2cfa0-3178-48d0-9c2f-245259e280e8","resolution":{"observed_at":"2026-08-11T04:17:57.818307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07149","last_updated":"2025-04-26T06:47:21Z","snapshot_observed_at":"2026-08-10T12:49:45.245447Z","submitted_at":"2024-10-09T17:55:02Z","title":"Towards Interpreting Visual Information Processing in Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07149","snapshot_observed_at":"2026-08-11T04:17:56.032176Z","title":"To- wards interpreting visual information processing in vision-language models.arXiv preprint arXiv:2410.07149, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.032176Z"},"links":{"cited_paper":"/paper/2410.07149","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:92cb0375021db05965487102b2867674d0a05704d13d5f708deba461fa266233","observation_id":"cdd46c79-02f1-4c4e-86bb-b856ba020424","resolution":{"observed_at":"2026-08-11T04:17:56.032176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11296","last_updated":"2025-05-22T23:03:47Z","snapshot_observed_at":"2026-08-09T11:09:57.531466Z","submitted_at":"2024-11-18T05:47:02Z","title":"Steering Language Model Refusal with Sparse Autoencoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11296","snapshot_observed_at":"2026-08-11T04:17:56.038373Z","title":"Steering language model refusal with sparse autoencoders.arXiv preprint arXiv:2411.11296, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.038373Z"},"links":{"cited_paper":"/paper/2411.11296","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:0f93f22aa41af4f0eed20a55b9695f9825f31ec51f65c31e4bc9e209b6c7863d","observation_id":"623a2370-84b8-4f4a-bf0b-0b8c4a7bd95c","resolution":{"observed_at":"2026-08-11T04:17:56.038373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.044310Z","title":"Zoom in: An introduction to circuits.Distill, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.044310Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:92a9cd31f1e2fdf41fcbc15fca093b0e6617de480809d629524ea7a4f118b3c5","observation_id":"bbc722ed-96ce-4a69-89d5-624cf509d697","resolution":{"observed_at":"2026-08-11T04:17:56.044310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.793501Z","title":"Visualizing representations: Deep learning and human beings","venue":null,"work_id":"a0e2f214-e987-4c48-8dc1-6de1822a8291","year":2015},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.049202Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:22996e5d5a546b0ebf4f2514ea51fbcd73adb3f394f9c5ae2b63144ed4f061af","observation_id":"058d2038-410f-42cd-9c2b-798bf255d421","resolution":{"observed_at":"2026-08-11T04:17:57.798542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.11277","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.736858Z","title":"Probing the representational power of sparse autoencoders in vision models","venue":null,"work_id":"40e23fdb-7689-43e1-a863-63f63734de87","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.054083Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:ba688b3e2fba9558494a1bbbb06c48c472ed8fdc76736318a222fc21948ccfe0","observation_id":"60c5603e-ea1d-40e2-b130-362652456e2b","resolution":{"observed_at":"2026-08-11T04:17:56.747243Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.777611Z","title":"Gpt-4o-mini: Advancing cost-efficient intelligence","venue":null,"work_id":"26acf1d7-c3ef-4b74-91ed-362754f23202","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.058945Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:97f7ee4438c0506bb1b89784650d80a596980337508a440c0186ac5bf4fc53e4","observation_id":"5b9793e9-4c4a-4e7c-862e-920e5d638bbe","resolution":{"observed_at":"2026-08-11T04:17:57.782692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.063731Z","title":"Sparse autoencoders learn monosemantic features in vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.063731Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:643a657921361d153ba024198b8dfa3dbd41cf8982554e35c56306cda7496598","observation_id":"377960dc-cb41-4e38-a7f4-d2932749b680","resolution":{"observed_at":"2026-08-11T04:17:56.063731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.761306Z","title":"Towards vision-language mechanistic interpretability: A causal tracing tool for blip","venue":null,"work_id":"7df5a156-61b5-4464-aef8-e5ce2788eec0","year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.068462Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:9011ba1bd7a91d0cd5cae996fb99ae3f2cdde8ed1ca23e462f4c65004dc5ebfd","observation_id":"1c619101-97ef-42f1-aae8-e70c8d36057a","resolution":{"observed_at":"2026-08-11T04:17:57.766065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09708","last_updated":"2026-04-28T03:29:39Z","snapshot_observed_at":"2026-08-10T21:52:19.966437Z","submitted_at":"2025-09-07T02:29:07Z","title":"Beyond I'm Sorry, I Can't: Dissecting Large Language Model Refusal","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09708","snapshot_observed_at":"2026-08-11T04:17:56.073278Z","title":"I’m sorry, I can’t","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.073278Z"},"links":{"cited_paper":"/paper/2509.09708","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:8887e84c5eab0b4c9673694edb709aa5d0cd79047a5569a1c6e2e768b80d85fe","observation_id":"94b2dead-18bc-4a07-af33-a10015ae3873","resolution":{"observed_at":"2026-08-11T04:17:56.073278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.745220Z","title":"Visual adversarial examples jailbreak aligned large language models","venue":null,"work_id":"5be6512c-6252-434f-bbed-3201ec09ef6c","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.078497Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:96724c20b3fb32e2893c087777e443673d527d29133c90bf224f925b82eaf46e","observation_id":"eacb6670-9287-4508-b7cc-10e65ab0b142","resolution":{"observed_at":"2026-08-11T04:17:57.750674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.728429Z","title":"Qwen-Scope: An open sparse autoencoder suite for the Qwen model family","venue":null,"work_id":"4ff78c88-55ee-4c64-8500-5e3af0878dec","year":2026},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.083263Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:8ba55abeccc5569e224734edfd99bbc67a4f9cfb67dc5a6ad9f24bb42032a30d","observation_id":"d5566a4c-bbc4-4029-82c9-0268f9e08351","resolution":{"observed_at":"2026-08-11T04:17:57.733675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.088107Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.088107Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:8f280581a99ddc6c105abead8467340d6f8e91125b6426329b9a43d2070101ed","observation_id":"fe447d69-874d-4cbd-b5a0-ea082f32f82e","resolution":{"observed_at":"2026-08-11T04:17:56.088107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14435","last_updated":"2024-08-01T17:42:04Z","snapshot_observed_at":"2026-08-08T18:10:15.134088Z","submitted_at":"2024-07-19T16:07:19Z","title":"Jumping Ahead: Improving Reconstruction Fidelity with JumpReLU Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14435","snapshot_observed_at":"2026-08-11T04:17:56.092721Z","title":"Jumping ahead: Improving reconstruction fidelity with JumpReLU sparse autoencoders.arXiv preprint arXiv:2407.14435, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.092721Z"},"links":{"cited_paper":"/paper/2407.14435","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:3a2bab65171c97df89bf0a397e2dc55ec8aa7ee91768d30898b226bafc78100a","observation_id":"eadbd835-4e5f-45e3-8fea-de3c5e559122","resolution":{"observed_at":"2026-08-11T04:17:56.092721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-11T04:17:56.097463Z","title":"Steering Llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.097463Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:e89c9f8333ed516750ea3eb9562ab725c225b5c2f8c632021c41fc95fa71b0c4","observation_id":"4641de98-7e7b-4fc5-a4ab-6302312a8412","resolution":{"observed_at":"2026-08-11T04:17:56.097463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.699795Z","title":"Multi- modal neurons in pretrained text-only transformers","venue":null,"work_id":"eefde3ea-f939-4d49-904d-c6fa5ba37549","year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.102224Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:b3f62b62c7a03d545a097359248b696a049084acaeeaf23951f8e38e192db87d","observation_id":"8c892395-c64d-4597-88bb-e01c606b2917","resolution":{"observed_at":"2026-08-11T04:17:57.705410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.683064Z","title":"SteerVLM: Robust model control through lightweight activation steering for vision language models","venue":null,"work_id":"7fbe20d3-5ad0-4763-911c-e5e7dfef8d4f","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.106645Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:07660060bf9adc30a30b2a2bb5ffdf78d464b1ec0fb6b50a345a2fb9fe0c8854","observation_id":"f298f62e-2df4-4676-8705-f70f9d84fe17","resolution":{"observed_at":"2026-08-11T04:17:57.688536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03118","last_updated":"2024-06-24T22:45:20Z","snapshot_observed_at":"2026-07-06T17:55:24.972926Z","submitted_at":"2024-04-03T23:57:34Z","title":"LVLM-Interpret: An Interpretability Tool for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03118","snapshot_observed_at":"2026-08-11T04:17:56.111721Z","title":"Lvlm-interpret: an interpretability tool for large vision-language models.arXiv preprint arXiv:2404.03118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.111721Z"},"links":{"cited_paper":"/paper/2404.03118","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:0cd67d39f5b341e3380088869b59f6fcf12a0eaf06dc21e83d829cb5096cdf88","observation_id":"830f7044-5311-48c7-b4a4-e492efe747ce","resolution":{"observed_at":"2026-08-11T04:17:56.111721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03555","last_updated":"2024-12-04T18:50:42Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:50:42Z","title":"PaliGemma 2: A Family of Versatile VLMs for Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03555","snapshot_observed_at":"2026-08-11T04:17:56.116317Z","title":"PaliGemma 2: A family of versatile VLMs for transfer.arXiv preprint arXiv:2412.03555, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.116317Z"},"links":{"cited_paper":"/paper/2412.03555","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:fee067b6825e8f1b621902ac6e67a7ce3e91db94b511701aabfbc1b812291efb","observation_id":"ea2aabab-eee9-460d-ba2a-2b5538ff20e5","resolution":{"observed_at":"2026-08-11T04:17:56.116317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.122564Z","title":"Daniel Freeman, Theodore R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.122564Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:c61bb79ee125855c5ccec92d639bf90ca4bf16d740a2d860e1712a78c64eaaae","observation_id":"652c6242-0c83-45b3-84c8-a17a7d903b88","resolution":{"observed_at":"2026-08-11T04:17:56.122564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.654572Z","title":"Li, Arnab Sen Sharma, Aaron Mueller, Byron C","venue":null,"work_id":"aae89190-8118-4c46-aea5-50f3d933edb9","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.127927Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:8976dfbd576e6cd74fb4f9520f3371f80d58db1fe5ec470fcb23195001a94466","observation_id":"ad666547-3921-415d-9f0d-0f41acd4ac5e","resolution":{"observed_at":"2026-08-11T04:17:57.659875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.132540Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.132540Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:f43b454e7d05e0b97a9e13330db4fc197ffca3a98f05d02e3ed38c7760eb9345","observation_id":"d37558b3-dc39-493d-bf70-b84cb8eedef5","resolution":{"observed_at":"2026-08-11T04:17:56.132540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-11T04:17:56.137372Z","title":"Vazquez, Ulisse Mini, and Monte MacDiarmid","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.137372Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:113c99bd9915dcca7978d8b63511a7be585b6d919d60cbf799bb0a1175cf4461","observation_id":"4f30b446-4ab4-4a1a-a778-10e1ba21a3ed","resolution":{"observed_at":"2026-08-11T04:17:56.137372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.622333Z","title":"Too late to recall: The two-hop problem in multimodal knowledge retrieval","venue":null,"work_id":"5147a85d-fed6-44bf-8876-35a792810d15","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.142365Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:1656cf053b782bb16c3a4d5a295f011d4a57353f783e8d1eaad92f1d0b998715","observation_id":"a5e3ee40-f7fd-46f4-9da1-684f3115af2c","resolution":{"observed_at":"2026-08-11T04:17:57.628662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11976","last_updated":"2025-06-22T00:39:23Z","snapshot_observed_at":"2026-08-11T20:33:04.146508Z","submitted_at":"2025-06-13T17:34:05Z","title":"How Visual Representations Map to Language Feature Space in Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11976","snapshot_observed_at":"2026-08-11T04:17:56.147155Z","title":"How visual representations map to language feature space in multimodal llms.arXiv preprint arXiv:2506.11976, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.147155Z"},"links":{"cited_paper":"/paper/2506.11976","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:a831817dc69717bde1115d214d032e86413d429533839687aa6182974e3ed772","observation_id":"e97f989c-c33a-4426-8979-5210adbd71a5","resolution":{"observed_at":"2026-08-11T04:17:56.147155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.606190Z","title":"Steering away from harm: An adaptive approach to defending vision language model against jailbreaks","venue":null,"work_id":"4350efb8-e7cd-429f-9804-53ba6cb3d0dd","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.152172Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:59d6c22a10aa425a3f0d0fb3c672e6c6051d1f552e9433b97e5b1dd9d72a5ebc","observation_id":"9ddfa148-7c15-4249-9c65-72225f1a76bd","resolution":{"observed_at":"2026-08-11T04:17:57.611779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-11T04:17:56.156829Z","title":"Internvl3.5: Advancing open-source multimodal models in versatility, reasoning, and efficiency, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.156829Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:cd7278e655dde6532258c7ba3b2184793b786ea39b6fd0be23f76e59b841831a","observation_id":"3ad407f8-f160-46c8-9936-e40a5904103c","resolution":{"observed_at":"2026-08-11T04:17:56.156829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.589906Z","title":"AdaShield: Safeguarding multimodal large language models from structure-based attack via adaptive shield prompting","venue":null,"work_id":"59a81038-a373-4d48-965f-25a4d75b88df","year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.162853Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:7f6f50f0846c5256f2183019f0094cd377fcebb938f495287fea72f3fe67682e","observation_id":"3b14a2e9-6053-4aa2-9b6a-279769fe4d46","resolution":{"observed_at":"2026-08-11T04:17:57.595098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10440","last_updated":"2025-07-21T03:53:30Z","snapshot_observed_at":"2026-08-07T09:36:29.319006Z","submitted_at":"2024-11-15T18:58:31Z","title":"LLaVA-CoT: Let Vision Language Models Reason Step-by-Step","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10440","snapshot_observed_at":"2026-08-11T04:17:56.167527Z","title":"Llava-o1: Let vision language models reason step-by-step.arXiv preprint arXiv:2411.10440, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.167527Z"},"links":{"cited_paper":"/paper/2411.10440","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:80dca66595ff1b9ba99ca042e8b6cbdeeef5ddab3960acbc13005b851d0c92fc","observation_id":"47a8435a-2c41-4f4a-81e8-3c19919d4f69","resolution":{"observed_at":"2026-08-11T04:17:56.167527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-11T04:17:56.172320Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.172320Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:17b78a52b08f17ccce93e6e50191ec8136686a2587f8bba83274ac4bf4fa36bb","observation_id":"95f2b71b-43ef-4498-9931-0584ebf2d855","resolution":{"observed_at":"2026-08-11T04:17:56.172320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.177100Z","title":"SafeSteer: Adaptive subspace steering for efficient jailbreak defense in vision-language models.arXiv preprint arXiv:2509.21400, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.177100Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:f7adc29d7581215f49493fba3faa7ec038efc96118bd9331bdf76a5cdf166f75","observation_id":"581e9dcf-2c1f-4833-b068-0610fedbe8bf","resolution":{"observed_at":"2026-08-11T04:17:56.177100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:56.181619Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.181619Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:106a7c59147dd0af0e750fc245b0078fcf343a70918e05057df4af8bc6d6953b","observation_id":"c093c9d3-d5cc-4865-8131-636221f4691f","resolution":{"observed_at":"2026-08-11T04:17:56.181619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16042","last_updated":"2024-01-17T04:07:06Z","snapshot_observed_at":"2026-08-08T04:58:14.317234Z","submitted_at":"2023-09-27T21:53:56Z","title":"Towards Best Practices of Activation Patching in Language Models: Metrics and Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16042","snapshot_observed_at":"2026-08-11T04:17:56.186065Z","title":"Towards best practices of activation patching in language models: Metrics and methods","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.186065Z"},"links":{"cited_paper":"/paper/2309.16042","citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:4c3b92d76c92c85cfb738a4f865f1d23edfc074ff3fa2ddfbc4ddb7a18ab6816","observation_id":"112922d6-827d-42aa-a3d2-3aea70380e8f","resolution":{"observed_at":"2026-08-11T04:17:56.186065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.561818Z","title":"Cross-modal information flow in multimodal large language models","venue":null,"work_id":"8fee5435-a1b6-4bda-b122-997b9f440cef","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.190937Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:5d3a115c80a999d94c41319856e9baba56430c681ddd4c1851aba81eeefcc3a1","observation_id":"f2b68228-1a9b-4451-b843-561f9a915118","resolution":{"observed_at":"2026-08-11T04:17:57.566959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.543903Z","title":"Multimodal situational safety","venue":null,"work_id":"0834f60f-bd6c-4161-b7e1-f43954ba7c54","year":2025},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.195809Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:46d47f9bfb83966437930805664d3c400600e10f677c092408b145956bd72a12","observation_id":"2619e432-0229-4ce4-9384-2c2445bcae20","resolution":{"observed_at":"2026-08-11T04:17:57.549778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.524183Z","title":"Relocated","venue":null,"work_id":"336b2c1e-8b60-42ef-a753-80cbb8ed8b3b","year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.201760Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:90fa123327e63ae1f9fbd11ee5601bf46f725bd471b153bc8b8cdd2f90c55927","observation_id":"e7d95dd4-96b3-42a8-bfa2-b16e8a5e4b3e","resolution":{"observed_at":"2026-08-11T04:17:57.530047Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.507104Z","title":null,"venue":null,"work_id":"be8ed473-e650-4a4b-a6b2-a22b66518988","year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.208372Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:ada69301d2996bfbbbc202112821c8ddcb8b6743783d7211b96907b5a78fd5e2","observation_id":"dd40ce95-4dfb-4b0e-bb9f-d4bfd52a465d","resolution":{"observed_at":"2026-08-11T04:17:57.512239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.489571Z","title":null,"venue":null,"work_id":"209a0b93-94bc-4235-bd2b-5c3a41f0abb4","year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.214057Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:89c49b3bdd1b9d3f8a9cc10bbcfa27eee847bd06cfd0e00ef82892eae0c627d8","observation_id":"7bbbfb87-1a52-4a94-8530-dc262d50d734","resolution":{"observed_at":"2026-08-11T04:17:57.494613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.473134Z","title":null,"venue":null,"work_id":"f41c804b-96bd-4d6b-ab6d-a6a36470e516","year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.219618Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:4fe13255c59d42f6de30da6bec11adb6a042199d2f1d514764469324564e85c7","observation_id":"418b9983-293a-4b05-83aa-d201d05c83b7","resolution":{"observed_at":"2026-08-11T04:17:57.478120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:17:57.456836Z","title":"this neuron activates for","venue":null,"work_id":"22c4ec09-0c11-411f-8514-e43b926ef579","year":null},"citing_paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T04:17:56.224644Z"},"links":{"citing_paper":"/paper/2608.09928"},"observation_digest":"sha256:0a275b3d2934e5e70d9336c76c670cebdb0524dea5c3c30dead8c4d9c54bd0e6","observation_id":"4447cbf9-6ef0-4020-9860-8acf0b877876","resolution":{"observed_at":"2026-08-11T04:17:57.462367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.09928","last_updated":"2026-08-10T17:59:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T05:23:18.073053Z","submitted_at":"2026-08-10T17:59:30Z","title":"Multimodal Model Diffing for Feature Discovery and Control"},"reference_resolution":{"displayed":99,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":74,"verified_exact":2,"verified_fuzzy":22},"total_outbound_references":99},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 99 of 99 outbound references and 0 inbound Pith citation observations for arXiv:2608.09928."}