{"as_of":"2026-08-08T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:552ef0f4fba469ed714d56ffd3d8d08e78d3af9c5065b6358db5d35d5c94e9fd","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:45:08.726791Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:15:45.641226Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-03T21:15:45.641226Z","title":"Grains: Gradient-based attribution for inference- time steering of llms and vlms.CoRR, abs/2507.18043,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16107","last_updated":"2026-07-21T01:49:54Z","snapshot_observed_at":"2026-08-07T08:36:47.121076Z","submitted_at":"2025-11-20T07:02:06Z","title":"T2T-VICL: Cross-Task Visual In-Context Learning via Implicit Text-Driven VLMs","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T21:15:45.641226Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2511.16107"},"observation_digest":"sha256:76420151b5568c8f98d6449404e42f3061add3426a5f9f11deab54b6bd768ef6","observation_id":"678ca0c8-c38f-4fe7-bc54-6f713fff697f","resolution":{"observed_at":"2026-08-03T21:15:45.641226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":"2507.18043","doi":"10.48550/arxiv.2507.18043","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grains: Gradient-based attribution for inference-time steering of llms and vlms.CoRR, abs/2507.18043, 2025a","venue":"ArXiv.org","work_id":"bcae005d-73ca-4483-9130-01c312dcceb2","year":2025},"citing_paper":{"arxiv_id":"2601.14004","last_updated":"2026-04-14T03:49:06Z","snapshot_observed_at":"2026-07-31T09:24:49.481740Z","submitted_at":"2026-01-20T14:23:23Z","title":"Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models","version":4},"reference_index":220,"source":"pdf_text","source_observed_at":"2026-05-16T12:39:57.398423Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2601.14004"},"observation_digest":"sha256:6a1d5df9c72b03bab3ac1cc0c6f6c9bdc130f562742223dc294964880d0b5b1d","observation_id":"47dc51af-060a-47b1-a192-6fa63f5668a5","resolution":{"observed_at":"2026-07-13T00:17:01.983164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":"2507.18043","doi":"10.48550/arxiv.2507.18043","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grains: Gradient-based attribution for inference-time steering of llms and vlms.CoRR, abs/2507.18043, 2025a","venue":"ArXiv.org","work_id":"bcae005d-73ca-4483-9130-01c312dcceb2","year":2025},"citing_paper":{"arxiv_id":"2604.06377","last_updated":"2026-05-05T18:37:43Z","snapshot_observed_at":"2026-07-06T22:54:53.308309Z","submitted_at":"2026-04-07T19:02:10Z","title":"The Master Key Hypothesis: Unlocking Cross-Model Capability Transfer via Linear Subspace Alignment","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:44.401045Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2604.06377"},"observation_digest":"sha256:20196d341641a23da260e8dda289dd98c5f947c7a36b422d1693e605c5ec9c63","observation_id":"d35ccd77-62a6-4cab-9aef-e20585a927c7","resolution":{"observed_at":"2026-07-13T00:17:01.983164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":"2507.18043","doi":"10.48550/arxiv.2507.18043","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grains: Gradient-based attribution for inference-time steering of llms and vlms.CoRR, abs/2507.18043, 2025a","venue":"ArXiv.org","work_id":"bcae005d-73ca-4483-9130-01c312dcceb2","year":2025},"citing_paper":{"arxiv_id":"2604.07006","last_updated":"2026-04-08T12:24:30Z","snapshot_observed_at":"2026-07-31T12:49:06.599745Z","submitted_at":"2026-04-08T12:24:30Z","title":"Continuous Interpretive Steering for Scalar Diversity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:08:02.296583Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2604.07006"},"observation_digest":"sha256:224672d7382ae6b0dc7a910cb02f71ddb2c6cf27cac3e480f837407eecd1d74c","observation_id":"04ddcd88-d3ec-46b6-b58f-1dbaebb94308","resolution":{"observed_at":"2026-07-13T00:17:01.983164Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"cited_work":{"arxiv_id":"2507.18043","doi":"10.48550/arxiv.2507.18043","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.18043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grains: Gradient-based attribution for inference-time steering of llms and vlms.CoRR, abs/2507.18043, 2025a","venue":"ArXiv.org","work_id":"bcae005d-73ca-4483-9130-01c312dcceb2","year":2025},"citing_paper":{"arxiv_id":"2605.28664","last_updated":"2026-05-27T15:59:45Z","snapshot_observed_at":"2026-08-07T19:59:30.749922Z","submitted_at":"2026-05-27T15:59:45Z","title":"Activation Steering for Synthetic Data Generation: The Role of Diversity in Downstream Safety Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T13:53:27.306664Z"},"links":{"cited_paper":"/paper/2507.18043","citing_paper":"/paper/2605.28664"},"observation_digest":"sha256:380ae0a48e4a559ccfc00c5bd7a62c500d1613109bff7be82eb2e5ac069fae1e","observation_id":"82b611a0-a29f-46fc-9616-bd1bb95bfcb5","resolution":{"observed_at":"2026-07-13T00:17:01.983164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.18043/citation-record","integrity":"/paper/2507.18043/integrity","json":"/paper/2507.18043/citation-record.json","paper":"/paper/2507.18043"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T14:45:08.572148Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.572148Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:92d696f173a9d90d31838a4b928adf909625bd035ceefdaa0e9c5b71d67ab55e","observation_id":"b21dbeae-8672-45f1-bbd8-86efa39101db","resolution":{"observed_at":"2026-08-06T14:45:08.572148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.263","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.798112Z","title":"A diagnostic study of explainability techniques for text classification","venue":null,"work_id":"723dfba7-ff27-4a84-b939-2c1b2d6c67a5","year":2020},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.575953Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:9263032d3a74bc252be3b28ffde3c35394efe4143043260ec9e3bb191e686054","observation_id":"d2a132a2-d174-4d2f-a068-fb19a78fa2e2","resolution":{"observed_at":"2026-08-06T14:45:08.801516Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.465304Z","title":"Madtp: Multimodal alignment-guided dynamic token pruning for accelerating vision-language transformer","venue":null,"work_id":"d28aa172-77e1-4ab3-aca5-4f059825e2e4","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.579024Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:fa630d1a2dadadce565badf5be894a3e4e04677a13199d3ba3b5b991db697fc9","observation_id":"7a2f0d49-3cf4-4906-bbe9-11933ca3da4b","resolution":{"observed_at":"2026-08-06T14:45:09.468380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.20404","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.262564Z","title":"Xprompt: Explaining large language model's generation via joint prompt attribution","venue":null,"work_id":"aa8dba81-049e-4425-8ada-20abfffecaef","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.582177Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:4b35076bf2a713bfa086fe2c11a65f884161c7b5a932870dd42969e975817eff","observation_id":"3201bf3e-025a-4982-93a6-c4fe254e9f0f","resolution":{"observed_at":"2026-08-06T14:45:09.267613Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15268","last_updated":"2024-11-22T12:22:21Z","snapshot_observed_at":"2026-08-08T10:38:10.039848Z","submitted_at":"2024-11-22T12:22:21Z","title":"ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15268","snapshot_observed_at":"2026-08-06T14:45:08.585297Z","title":"Ict: Image-object cross-level trusted intervention for mitigating object hallucination in large vision-language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.585297Z"},"links":{"cited_paper":"/paper/2411.15268","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:bc6e98993e26abd971a6522dc353631465f8e52f48e3e7aa6ac8777dc490ef43","observation_id":"472e75fd-80c5-4a34-abf7-c13dfc1fc7ab","resolution":{"observed_at":"2026-08-06T14:45:08.585297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18346","last_updated":"2024-11-13T17:17:43Z","snapshot_observed_at":"2026-08-07T08:36:46.172217Z","submitted_at":"2024-03-27T08:38:49Z","title":"Quantifying and Mitigating Unimodal Biases in Multimodal Large Language Models: A Causal Perspective","version":4},"cited_work":{"arxiv_id":"2403.18346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18346","snapshot_observed_at":"2026-08-06T14:45:09.164454Z","title":"Quantifying and Mitigating Unimodal Biases in Multimodal Large Language Models: A Causal Perspective","venue":"cs.CL","work_id":"5ddc06d3-c629-4518-bf30-8302f78b9e9a","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.588593Z"},"links":{"cited_paper":"/paper/2403.18346","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:59bf5de2e4be32c5f29cb4922f52d507a3033be602d3fe9d1eb308f65b7f0c1c","observation_id":"f7946dc7-3893-4d32-9ef0-0b864639c556","resolution":{"observed_at":"2026-08-06T14:45:09.167867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.456860Z","title":"Covert, Scott Lundberg, and Su-In Lee","venue":null,"work_id":"878439ea-f61b-4658-b09d-b06c0d67b384","year":2021},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.591990Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:63ab6833ef4f39ea7d7263af0a1db4e36ffb5202fefb10e50c86feef29e331dd","observation_id":"6a213b3b-a79b-4099-a489-265448e343e6","resolution":{"observed_at":"2026-08-06T14:45:09.459771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T14:45:08.594726Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.594726Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:f59943095cbf040a2648c0819e20918eebc430beebb930c366761f4763e85e52","observation_id":"7d61dc24-08f8-4ab9-9abf-82d767099187","resolution":{"observed_at":"2026-08-06T14:45:08.594726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.447974Z","title":"Frustratingly easy test-time adaptation of vision-language models","venue":null,"work_id":"1e2d5774-6e89-4e45-b4ec-0b33c66e6dd0","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.597549Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:8bc1a75c35456ded827d6bd0dec45062b795f2b68c3fd3696150ebc8de460360","observation_id":"8f0f6360-46fd-4638-bf8b-25ea3bd72a8f","resolution":{"observed_at":"2026-08-06T14:45:09.451008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18688","last_updated":"2025-06-14T04:20:06Z","snapshot_observed_at":"2026-07-06T19:58:13.816588Z","submitted_at":"2024-11-27T19:00:10Z","title":"Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18688","snapshot_observed_at":"2026-08-06T14:45:08.600409Z","title":"Immune: Improving safety against jailbreaks in multi-modal llms via inference-time alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.600409Z"},"links":{"cited_paper":"/paper/2411.18688","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:6f81f017ad9248c3d9a2d48e7fdedb33eee8cde626e3742d458783652f250dc2","observation_id":"76e45a9b-8330-462b-908d-a21adb85346c","resolution":{"observed_at":"2026-08-06T14:45:08.600409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.603323Z","title":"T oxi G en: A large-scale machine-generated dataset for adversarial and implicit hate speech detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.603323Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:5e20d2cc9467335bd8bd6d1ab8146f4524c8356df46b23b58f8ffe66baecd8b8","observation_id":"7ab32076-071c-4558-8c3c-479fce448f6c","resolution":{"observed_at":"2026-08-06T14:45:08.603323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.606012Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.606012Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:b5194121ac42f881cbb24c67e9fc295cabf9ac62fde6de689b3dcf9ae900688e","observation_id":"2da50cd6-d2d0-4cdc-9454-8fc2e2f81509","resolution":{"observed_at":"2026-08-06T14:45:08.606012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.434032Z","title":"Non-linear inference time intervention: Improving llm truthfulness","venue":null,"work_id":"2c96d0c3-d1df-4002-aba3-74315b974984","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.608618Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:76a5568f870f33a6e6ceb26312822af65861836163971bbff66a38683f28cc74","observation_id":"04a805b3-bdef-4baa-b9c3-9a167c888880","resolution":{"observed_at":"2026-08-06T14:45:09.437357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.611121Z","title":"Lo RA : Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.611121Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:42e52bdc04bbcd4e2ceb98fe172677e930cd6eb93ce85f3bd0b8e32f1d16f841","observation_id":"d17db6cb-0ee8-4567-9910-42f85b2e7710","resolution":{"observed_at":"2026-08-06T14:45:08.611121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.614115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.614115Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:b5631db1e1986b21aee7daa02dbcb929cb29aada0f6eebf9e713a0f5ba5f7226","observation_id":"25c45511-6ade-4fc4-bf25-a37e90e5a1c9","resolution":{"observed_at":"2026-08-06T14:45:08.614115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.616809Z","title":"A unified understanding and evaluation of steering methods","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.616809Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:9b6e8658778d8bd155b790bf962ce3b125615df0771a15448078b7a19eca5fde","observation_id":"43ee9a39-71cc-4eca-baab-d752563cdeb2","resolution":{"observed_at":"2026-08-06T14:45:08.616809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.412125Z","title":"Guided integrated gradients: An adaptive path method for removing noise","venue":null,"work_id":"f4672d04-5242-4547-8095-2f6906d1000a","year":2021},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.619720Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:546fe7e9c9a7d0a611414009edf89f3eac78266320752f0de0683812366c6eb6","observation_id":"3582b7c4-0072-4d99-95cb-f8f3687d2099","resolution":{"observed_at":"2026-08-06T14:45:09.415402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03012","last_updated":"2025-08-13T13:42:57Z","snapshot_observed_at":"2026-07-06T20:17:06.835639Z","submitted_at":"2025-01-06T13:37:13Z","title":"Analyzing Finetuning Representation Shift for Multimodal LLMs Steering","version":2},"cited_work":{"arxiv_id":"2501.03012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03012","snapshot_observed_at":"2026-08-06T14:45:09.068550Z","title":"Analyzing Finetuning Representation Shift for Multimodal LLMs Steering","venue":"cs.AI","work_id":"bac9a892-bd62-43cd-b4e4-1b96ef43b231","year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.622861Z"},"links":{"cited_paper":"/paper/2501.03012","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:fe036df682b22c93bc69f1c8d8bd55a22f69a05ee0fc9e76441b4bb7481f91ff","observation_id":"efa84903-f5b9-434b-8227-86218e39290e","resolution":{"observed_at":"2026-08-06T14:45:09.072091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.402225Z","title":"Mitigating object hallucinations in large vision-language models through visual contrastive decoding","venue":null,"work_id":"ad4d6c55-dc3e-48f0-804f-bbeca93674f3","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.625935Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:498d7b36dfa64a09d88e3a065d7d7ad4950c080ed442e14cc6c285fd683f64bb","observation_id":"71fc0b72-392e-40eb-ad55-08afc769ee97","resolution":{"observed_at":"2026-08-06T14:45:09.405497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.392424Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":"0cbe1ad0-7efb-4c75-b924-3ccb48e7d7c4","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.629137Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:3e74dd502dd03da22be4752614a4d9e3899ed44bdafcb2730ee36d7b23308aeb","observation_id":"2b00a94e-42cd-4214-a91e-cc483e2c660c","resolution":{"observed_at":"2026-08-06T14:45:09.395690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.382776Z","title":"Learning without forgetting","venue":null,"work_id":"f5036ce3-8d82-4d69-962a-df9aabd1e513","year":2017},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.631701Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:b9ecb4bb9535131188b6634abce7d13d9891cccf6198b245240dc6987abcae05","observation_id":"c3260a3d-e4c9-42e8-b920-f6b1b8176bde","resolution":{"observed_at":"2026-08-06T14:45:09.385719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.634281Z","title":"T ruthful QA : Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.634281Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:fabb981c985175184f8b29f6715d0ca1f270cdb2574bdb2ffa75a48b771489e2","observation_id":"cd2dd1af-1e0c-49bc-bd2a-2b4f748b7f53","resolution":{"observed_at":"2026-08-06T14:45:08.634281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17516","last_updated":"2025-02-22T20:55:26Z","snapshot_observed_at":"2026-08-08T10:56:10.786814Z","submitted_at":"2025-02-22T20:55:26Z","title":"A Survey on Mechanistic Interpretability for Multi-Modal Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17516","snapshot_observed_at":"2026-08-06T14:45:08.637173Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.637173Z"},"links":{"cited_paper":"/paper/2502.17516","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:72b92757fbe79d9b67eb4bc029c6553ac8fb57a57f291a56f03f6eb21d1dc7d6","observation_id":"7f7a930d-396f-4b96-8eb2-45c9931602cd","resolution":{"observed_at":"2026-08-06T14:45:08.637173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.640083Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.640083Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:f92a24278d6ff67c27c9016598dd026e17f73de2ea9ede84a1db9873cd359fda","observation_id":"22c972f3-8ab0-4eed-a648-6646e4c90cbe","resolution":{"observed_at":"2026-08-06T14:45:08.640083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15778","last_updated":"2024-10-22T05:01:28Z","snapshot_observed_at":"2026-07-06T19:36:54.626904Z","submitted_at":"2024-10-21T08:42:30Z","title":"Reducing Hallucinations in Vision-Language Models via Latent Space Steering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15778","snapshot_observed_at":"2026-08-06T14:45:08.642780Z","title":"Reducing hallucinations in vision-language models via latent space steering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.642780Z"},"links":{"cited_paper":"/paper/2410.15778","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:7d1461b75707ed2cd01297997aabc5447b7a22e6b6e9097444a6376f1cee4983","observation_id":"a7532f68-77b1-4b10-8712-fc3f60676dca","resolution":{"observed_at":"2026-08-06T14:45:08.642780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.368419Z","title":"In-context vectors: Making in context learning more effective and controllable through latent space steering","venue":null,"work_id":"6eebde4c-1628-498d-83a7-5cc6bcd5959d","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.645791Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:7313959a32fbcf3543ee619f6a45bfc8b77b3a0eb67651682bda8da5d3c9c704","observation_id":"4ff7d5fc-9ae2-44c6-bbe3-9bc4f78136a1","resolution":{"observed_at":"2026-08-06T14:45:09.371802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.648568Z","title":"Gradient episodic memory for continual learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.648568Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:43aef3db1058e06a29110cff51f10dbd06c0047da966cd9fbc8e2d833c7b0984","observation_id":"08649fc5-66b9-4b34-a3b9-caac353363b6","resolution":{"observed_at":"2026-08-06T14:45:08.648568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-06T14:45:08.651325Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.651325Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:76945039fe0bfc78e2828f65ae17fab1ecc1d6f203b12d43944782645842b323","observation_id":"307e13ad-cde6-43d4-bb0d-cd12def26bbb","resolution":{"observed_at":"2026-08-06T14:45:08.651325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.354311Z","title":"Faitheval: Can your language model stay faithful to context, even if ''the moon is made of marshmallows''","venue":null,"work_id":"28d55197-83b4-4490-8257-521749eaf630","year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.654306Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:cddbdc6db77307225e1d392deed76ff8f94ae37846a2d6c1b4577fb08d50a087","observation_id":"c5d6b8ea-6ce1-4d61-a002-fdd8235e00d4","resolution":{"observed_at":"2026-08-06T14:45:09.357480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.15758","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.021620Z","title":"Risk-aware distributional intervention policies for language models","venue":null,"work_id":"f67b636f-2fc1-4bc9-8a63-1236fdb62db3","year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.657077Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:b5fee28fba516bbd961b2e75d85765b0b0139a524d0ce3825808e0e56637b121","observation_id":"90409f6c-d5da-4fb9-9a06-071da951e821","resolution":{"observed_at":"2026-08-06T14:45:09.026204Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12446","last_updated":"2026-07-10T01:07:20Z","snapshot_observed_at":"2026-08-07T18:10:30.414098Z","submitted_at":"2025-02-18T02:27:23Z","title":"Multi-Attribute Steering of Language Models via Targeted Intervention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12446","snapshot_observed_at":"2026-08-06T14:45:08.659788Z","title":"Multi-attribute steering of language models via targeted intervention, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.659788Z"},"links":{"cited_paper":"/paper/2502.12446","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:22fb34e32c3115585822978741a843c8da556a497d70cae53da3de32c22ec88a","observation_id":"c87a7114-afc0-463e-ad52-323906112331","resolution":{"observed_at":"2026-08-06T14:45:08.659788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-06T14:45:08.662726Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.662726Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:1e47bd7ca1925d0e17d237c0742cf8b1003f60801ea64b672df915752f494c11","observation_id":"bf484691-5e92-4699-a0c7-f686fe385641","resolution":{"observed_at":"2026-08-06T14:45:08.662726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.665561Z","title":"Combining feature and instance attribution to detect artifacts","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.665561Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:02695ad7a898a0ec5eb971e305e4960a284c916b834dad97fd5484921e1393ef","observation_id":"9e31f871-3e83-46f5-a1c1-0675b521466f","resolution":{"observed_at":"2026-08-06T14:45:08.665561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.668433Z","title":"Householder pseudo-rotation: A novel approach to activation editing in LLM s with direction-magnitude perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.668433Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:3ec0e35028af16a94cee0f21241fbac29caab878dae1dac0ad41c3bf27ff050d","observation_id":"b3ab98e7-b1de-46dc-bcbc-c66f88fff68c","resolution":{"observed_at":"2026-08-06T14:45:08.668433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.345263Z","title":"Rewarded soups: towards pareto-optimal alignment by interpolating weights fine-tuned on diverse rewards","venue":null,"work_id":"9996d5fe-96dd-4bbf-a08c-a4444f18fc93","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.671136Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:15e5e3ffb22649e2d1df94ec6efb515269fdfbdc1ab41d404060be13ea296e90","observation_id":"f429a8e2-4c78-4c9c-bf63-850a4535e52a","resolution":{"observed_at":"2026-08-06T14:45:09.348565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.674114Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.674114Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:717a36689190b6b4d3347af194d74884566368ea0ee8781194a4717cf00c5f10","observation_id":"d909c43d-62fc-492d-bd0f-027cb67db8d8","resolution":{"observed_at":"2026-08-06T14:45:08.674114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.336262Z","title":"A consistent and efficient evaluation strategy for attribution methods","venue":null,"work_id":"22be3823-ca94-469c-aa21-f805ec0d69b1","year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.677039Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:c6445b833716bb0c598f97120d71e2a77e0cd67e6882f9fb8ace8a2a3bcedd87","observation_id":"250a1e14-e315-43cd-a800-c86a6dff5b33","resolution":{"observed_at":"2026-08-06T14:45:09.339433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.327618Z","title":"Are vision-language transformers learning multimodal representations? a probing perspective","venue":null,"work_id":"26406f80-b5ce-4967-bf58-fdb7a7dd2f42","year":2022},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.679731Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:c73be08a42eeb6553558740a48f9cefe0ba72d169bed400856fab218cea2cbe1","observation_id":"9949bf89-c3a2-4818-b9ed-35abec54c628","resolution":{"observed_at":"2026-08-06T14:45:09.330728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.318866Z","title":"Smith, and Simon Shaolei Du","venue":null,"work_id":"26c18eb7-c5a8-45e2-ab9e-949d86c3a3b7","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.682504Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:94cec831d31218d8f3dda32a6fbfab5951dfea8f10ccc6f2da315ef17b47329e","observation_id":"3e589c6d-1c9c-4c44-917a-7f39cbedc15f","resolution":{"observed_at":"2026-08-06T14:45:09.321912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03825","last_updated":"2017-06-12T19:53:30Z","snapshot_observed_at":"2026-07-06T05:46:32.599765Z","submitted_at":"2017-06-12T19:53:30Z","title":"SmoothGrad: removing noise by adding noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03825","snapshot_observed_at":"2026-08-06T14:45:08.685271Z","title":"Smoothgrad: removing noise by adding noise, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.685271Z"},"links":{"cited_paper":"/paper/1706.03825","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:9d4965909155ff036e8cef98c6d2cb245e4afdf188bdc5b428d3d954d5c9bf95","observation_id":"d4b3c61d-32f4-4365-84f7-f216dfbea6e6","resolution":{"observed_at":"2026-08-06T14:45:08.685271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.309845Z","title":"Efficient open-set test time adaptation of vision language models","venue":null,"work_id":"26c53983-a3b1-4564-aa5a-496932fc0970","year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.688226Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:baa3dded2f72fb046cb581cb5795aef17048f80a7e34c07fe3dd2b4c7f9d749a","observation_id":"fc9b94f9-54e9-4fac-98a5-39e8de287198","resolution":{"observed_at":"2026-08-06T14:45:09.312946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-naacl.242","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.751801Z","title":"LVP runing: An effective yet simple language-guided vision token pruning approach for multi-modal large language models","venue":null,"work_id":"db6fda49-db5f-431b-b9e8-77d3d7dbdd8b","year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.691139Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:c03e5828c0c9ece1b5e4d964e85b7f636afc4f8c8168f2b5a0df37dbd4c0564f","observation_id":"c2d1f33e-2cb3-4dbf-803e-9a075293b848","resolution":{"observed_at":"2026-08-06T14:45:08.756999Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14525","last_updated":"2023-09-25T20:59:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-25T20:59:33Z","title":"Aligning Large Multimodal Models with Factually Augmented RLHF","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14525","snapshot_observed_at":"2026-08-06T14:45:08.693838Z","title":"Aligning large multimodal models with factually augmented rlhf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.693838Z"},"links":{"cited_paper":"/paper/2309.14525","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:efe4d6404cb51983dc50aa07dc2585af53205f67c6e6ae4c65905e8437ce6086","observation_id":"a84a0dbb-863d-4fcb-9ac2-f169a35cd4f6","resolution":{"observed_at":"2026-08-06T14:45:08.693838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.300342Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"d49fda4b-eb8b-40a7-8822-1f4d9c9f70e8","year":2017},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.696753Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:e95e84a8133950254e10603fa2029149bd1d6a036913677af21e1681f1c889df","observation_id":"1c2a945c-42f9-4d1e-b88d-d02ae2cd1484","resolution":{"observed_at":"2026-08-06T14:45:09.304142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T14:45:08.699397Z","title":"Gemini: A family of highly capable multimodal models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.699397Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:fc36176863b697de3fb76fa9e5c9e25f3f12d89c54ebca51617e5c3c422b2d04","observation_id":"07fda6dd-1818-49fb-8499-74aa319d0eaa","resolution":{"observed_at":"2026-08-06T14:45:08.699397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-06T14:45:08.701915Z","title":"Gemma 3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.701915Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:1e6dc557cd450e1a6d20fbfa9a097b7c97393de4b033263ca7bfd052103b90c4","observation_id":"d7aa9766-d119-414c-8595-a070a843e9ba","resolution":{"observed_at":"2026-08-06T14:45:08.701915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.704780Z","title":"Qwen2.5: A party of foundation models, September 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.704780Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:9d826c30aed2904db0478458f83b1d4df619d2de53f333fb1e245956052784f2","observation_id":"518427e3-aa99-4980-ba79-0eb85226a8c6","resolution":{"observed_at":"2026-08-06T14:45:08.704780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-06T14:45:08.707384Z","title":"Vazquez, Ulisse Mini, and Monte MacDiarmid","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.707384Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:bbcd4cb332c8da5115ace942cd7dca3582f676e1173d0b316f716b4ab4ae8bc3","observation_id":"5393a4fa-0e7e-457a-a5d9-1b62a0130e89","resolution":{"observed_at":"2026-08-06T14:45:08.707384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:09.286498Z","title":"Contrastive region guidance: Improving grounding in vision-language models without training","venue":null,"work_id":"a1fca2eb-1ee6-46e5-834b-37e517541e86","year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.709928Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:867702bec50c5041f3d97f95684b5a4980441bfd02a503f0371bb732bd4e9e5e","observation_id":"9641300d-4a91-494e-b546-e32db362dc7b","resolution":{"observed_at":"2026-08-06T14:45:09.289794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10010","last_updated":"2023-05-17T07:40:12Z","snapshot_observed_at":"2026-08-05T05:48:31.993288Z","submitted_at":"2023-05-17T07:40:12Z","title":"AD-KD: Attribution-Driven Knowledge Distillation for Language Model Compression","version":1},"cited_work":{"arxiv_id":"2305.10010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10010","snapshot_observed_at":"2026-08-06T14:45:08.852421Z","title":"AD-KD: Attribution-Driven Knowledge Distillation for Language Model Compression","venue":"cs.CL","work_id":"1cbf2822-4bb8-4216-8d33-d12d645afcec","year":2023},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.712547Z"},"links":{"cited_paper":"/paper/2305.10010","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:caeca97d1adc0f25cfbadfdb1b1799c47768763cb8e3ee42de0e9611479fe83f","observation_id":"6c4c1097-4f9f-4e3d-9636-c38df5f3b42c","resolution":{"observed_at":"2026-08-06T14:45:08.856617Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13817","last_updated":"2025-03-17T16:05:34Z","snapshot_observed_at":"2026-07-06T20:09:14.917734Z","submitted_at":"2024-12-18T13:04:30Z","title":"Nullu: Mitigating Object Hallucinations in Large Vision-Language Models via HalluSpace Projection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13817","snapshot_observed_at":"2026-08-06T14:45:08.715420Z","title":"Nullu: Mitigating object hallucinations in large vision-language models via halluspace projection, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.715420Z"},"links":{"cited_paper":"/paper/2412.13817","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:45129610155e8284787d24ee204e6f82fcc637758532defd135e96338eabfbab","observation_id":"b4d6127e-65cb-4c24-9b3a-0da6255b599a","resolution":{"observed_at":"2026-08-06T14:45:08.715420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:45:08.718348Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.718348Z"},"links":{"citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:5bdcd21927139245ba5de0043499a51bfa600d641ce0489c4111a0092c841766","observation_id":"44b2cb02-fdb6-45b0-bfc3-3bae28d1c682","resolution":{"observed_at":"2026-08-06T14:45:08.718348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-08T01:23:11.364463Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-06T14:45:08.721119Z","title":"Spa-vl: A comprehensive safety preference alignment dataset for vision language model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.721119Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:a72483c04c822e81a6b52008e636e3c8a311550253ac3071ef562b76801b8d4f","observation_id":"d841a76a-6ab2-4fe8-8b92-cefda9142c5a","resolution":{"observed_at":"2026-08-06T14:45:08.721119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09248","last_updated":"2025-03-17T06:59:16Z","snapshot_observed_at":"2026-08-07T17:10:28.747528Z","submitted_at":"2025-03-12T10:42:11Z","title":"Bayesian Test-Time Adaptation for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09248","snapshot_observed_at":"2026-08-06T14:45:08.723935Z","title":"Bayesian test-time adaptation for vision-language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.723935Z"},"links":{"cited_paper":"/paper/2503.09248","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:d0c2489797ff208b890d8d7c52bb582b28fd7d5a3e4274bfaf5d7fef0171d3b5","observation_id":"27dad7be-ea30-489b-bef2-e3dabe09eaff","resolution":{"observed_at":"2026-08-06T14:45:08.723935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T14:45:08.726791Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T14:45:08.726791Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.18043"},"observation_digest":"sha256:e6ee7282a47e9d0fe084b77ad3f127c1b88d64177defe795b73c24dfca0cd4f2","observation_id":"e742f20d-6cef-48ab-b058-ac76114d6c0d","resolution":{"observed_at":"2026-08-06T14:45:08.726791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18043","last_updated":"2026-07-10T01:02:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T17:22:41.556728Z","submitted_at":"2025-07-24T02:34:13Z","title":"GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":7,"verified_fuzzy":17},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 5 inbound Pith citation observations for arXiv:2507.18043."}