{"as_of":"2026-08-07T08:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5ca577c09dd21065732917a034cfe710efa789a38c95db679eb0e5eaa480883","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T02:40:39.162784Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.14280/citation-record","integrity":"/paper/2607.14280/integrity","json":"/paper/2607.14280/citation-record.json","paper":"/paper/2607.14280"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:35.506325Z","title":"Flamingo: a visual language model for few-shot learning.Advances in Neural Information Processing Systems (NeurIPS), 35:23716–23736, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:35.506325Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:76d917881a328d354f1b941bf81dd02b843bfe2b9ff114390147921300599f3c","observation_id":"f3427038-a19f-42cf-a590-2bf1babc13e2","resolution":{"observed_at":"2026-08-02T02:40:35.506325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11717","snapshot_observed_at":"2026-08-02T02:40:35.586733Z","title":"Refusal in language models is mediated by a single direction.arXiv preprint arXiv:2406.11717, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:35.586733Z"},"links":{"cited_paper":"/paper/2406.11717","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:9a8787e78174bf77cc27cd5b793c02aad3d7c3a4d349332ab093c09859722211","observation_id":"2a30d7ba-9533-40e5-bdde-87a241b0f689","resolution":{"observed_at":"2026-08-02T02:40:35.586733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.28119","last_updated":"2026-04-30T17:08:07Z","snapshot_observed_at":"2026-07-31T15:51:05.350286Z","submitted_at":"2026-04-30T17:08:07Z","title":"Do Sparse Autoencoders Capture Concept Manifolds?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.28119","snapshot_observed_at":"2026-08-02T02:40:35.723487Z","title":"Do sparse autoencoders capture concept manifolds?arXiv preprint arXiv:2604.28119, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:35.723487Z"},"links":{"cited_paper":"/paper/2604.28119","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:270d06154d62336f3eb8e2b4e04a383f4d9ce16c091d18766074b50e3d2705b7","observation_id":"6dc3674a-bc72-4ea7-b059-1d480503630f","resolution":{"observed_at":"2026-08-02T02:40:35.723487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:35.852924Z","title":"Language models are few-shot learners.Advances in Neural Information Processing Systems (NeurIPS), 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:35.852924Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:5a4f2fce42f16b643f3c7f1f80a217896a7154989570d616804d1078b0960a32","observation_id":"ba6503d9-4bc4-4e5a-b0ab-6c96a4bc06bf","resolution":{"observed_at":"2026-08-02T02:40:35.852924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:35.914579Z","title":"Observing and controlling features in vision-language-action models.arXiv preprint arXiv:2603.05487, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:35.914579Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:0cd0e26af4ac8391e453c333d84074eab8120af3c04cf9f063a85677d0b78133","observation_id":"120e8c9b-123f-48b5-8a7a-d094de50e1ea","resolution":{"observed_at":"2026-08-02T02:40:35.914579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-02T02:40:36.096408Z","title":"Toy models of superposition.arXiv preprint arXiv:2209.10652, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.096408Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:89d22b72b6ee8fe40277e0a5d3025e5cdc25f49e7281e58f277213f01d348def","observation_id":"8dde5830-9c05-4b3c-b17c-cad3fd708abf","resolution":{"observed_at":"2026-08-02T02:40:36.096408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:36.180715Z","title":"Not all language model features are one-dimensionally linear","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.180715Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:3809e11b64416634d9ba04b67caf6e47816b61f968492d88b26b094feb01b9c9","observation_id":"8678e445-db98-4b56-920e-fc76d4637c67","resolution":{"observed_at":"2026-08-02T02:40:36.180715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02881","last_updated":"2026-05-08T04:21:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T17:51:21Z","title":"MolmoAct2: Action Reasoning Models for Real-world Deployment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.02881","snapshot_observed_at":"2026-08-02T02:40:36.286530Z","title":"Molmoact2: Action reasoning models for real-world deployment.arXiv preprint arXiv:2605.02881, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.286530Z"},"links":{"cited_paper":"/paper/2605.02881","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:4e3200cb72f0a3d723b3bdbe53f64a2dfe73b2d0226e323622ec0c5ebde1dc02","observation_id":"cf7ae672-17fb-434a-a3b0-84017c78795e","resolution":{"observed_at":"2026-08-02T02:40:36.286530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08638","last_updated":"2026-05-07T19:12:12Z","snapshot_observed_at":"2026-07-06T22:32:13.055128Z","submitted_at":"2025-10-08T22:42:20Z","title":"Into the Rabbit Hull: From Task-Relevant Concepts in DINO to Minkowski Geometry","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.08638","snapshot_observed_at":"2026-08-02T02:40:36.370496Z","title":"Into the rabbit hull: From task-relevant concepts in dino to minkowski geometry.arXiv preprint arXiv:2510.08638, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.370496Z"},"links":{"cited_paper":"/paper/2510.08638","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:139f4e8975b349b58988957f9675133a2cd61f02a79be31cbcd60f63754c86c9","observation_id":"7b14d983-37a2-4af7-832f-d19cce02f6bd","resolution":{"observed_at":"2026-08-02T02:40:36.370496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:36.551513Z","title":"Pot: Python optimal transport.Journal of Machine Learning Research, 22(78):1–8, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.551513Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:377a93da8f9ce2bc3fcd0170b1ea0f0c6622054c62f565e099bd5aed5d35e6f7","observation_id":"8c1350fa-3ba2-484d-b98d-3404970b62c0","resolution":{"observed_at":"2026-08-02T02:40:36.551513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:36.683377Z","title":"Mechanistic interpretability for steering vision-language-action models.Conference on Robot Learning (CoRL), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.683377Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:a8cea664249cb69bea84c68631719022fa7f07a88256c1c015c307b745c7fe02","observation_id":"3c86c9f4-cc50-41d1-ac27-748b97a1308f","resolution":{"observed_at":"2026-08-02T02:40:36.683377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:36.881882Z","title":"An- alyzing fine-tuning representation shift for multimodal llms steering alignment.International Conference on Computer Vision, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:36.881882Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:1cddec15b3988351cd9aaea0be716de8526b51a576516a68752e62ff364f1621","observation_id":"13a74650-c95e-4844-93f9-16cc65fce2cb","resolution":{"observed_at":"2026-08-02T02:40:36.881882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-02T02:40:37.026430Z","title":"Openvla: An open-source vision-language-action model.arXiv preprint arXiv:2406.09246, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.026430Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:9d62fcf3c84c8ec5a3bf8a70b046fffc967fd32d5ab7c4e72a6583e5e6b712fc","observation_id":"069c8e2d-7624-4379-9476-738f6ddbd6d0","resolution":{"observed_at":"2026-08-02T02:40:37.026430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-02T02:40:37.179132Z","title":"Auto-encoding variational bayes.arXiv preprint arXiv:1312.6114, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.179132Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:0c061f42b8146e4401b31e5dc0fa5ed4f87dcd5d762b660599898966685de9a1","observation_id":"986a4fb8-74a9-4271-8292-8b9fef74e44b","resolution":{"observed_at":"2026-08-02T02:40:37.179132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-02T02:40:37.340685Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.340685Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:25989ba2cc2a8b320175250e4a0a6f6619ac1b841ba04ccd87a025abc06abfef","observation_id":"faab1575-d75a-4c1c-8016-02174d1fc844","resolution":{"observed_at":"2026-08-02T02:40:37.340685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:37.486935Z","title":"Libero: Benchmarking knowledge transfer for lifelong robot learning.Advances in Neural Information Processing Systems, 36:44776–44791, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.486935Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:f2b9327cc2085f1247738d50d9463e0e55e28dd34c8d2dc247f5eef720a08f60","observation_id":"a8f32887-4d43-4ccb-a5e7-2862122ee2e7","resolution":{"observed_at":"2026-08-02T02:40:37.486935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:37.602817Z","title":"Sparse autoencoders learn monosemantic features in vision-language models.Advances in Neural Information Processing Systems, 38:95706–95742, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.602817Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:891dbfa7fd818276392388bc3dde8b2d8236a75da04d42b46816d4c35eee7ed6","observation_id":"b3d1aa53-b579-48ee-9565-3a8d10bcce68","resolution":{"observed_at":"2026-08-02T02:40:37.602817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-06T00:58:30.657180Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-02T02:40:37.783344Z","title":"Steering llama 2 via contrastive activation addition.arXiv preprint arXiv:2312.06681, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.783344Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:760b1905393172d11d35655dddcbe998b8e704df3a027390869070a91ac0da13","observation_id":"4854176b-10ef-4120-9c37-9d140b99f210","resolution":{"observed_at":"2026-08-02T02:40:37.783344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:37.875011Z","title":"Learning to steer: Input-dependent steering for multimodal llms.Advances in Neural Information Processing Systems, 38:159799–159834, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.875011Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:1a4b6aaf1e591f667c32c6bf1acd3edad586ac3ffcfa40dbbcd64a9dfbfad744","observation_id":"da093ff9-40fb-406d-bc10-9d6d111fbb68","resolution":{"observed_at":"2026-08-02T02:40:37.875011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-02T02:40:37.980804Z","title":"The linear representation hypothesis and the geometry of large language models.arXiv preprint arXiv:2311.03658, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:37.980804Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:6fca7cb83e2b410f0e9a19bdf36468894d62249e926c1906aa5b93ecd01dd07a","observation_id":"8d97f847-b05c-4ef1-9ff9-0cf5190eec42","resolution":{"observed_at":"2026-08-02T02:40:37.980804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-02T02:40:38.119936Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.119936Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:969e00cc4d12f9b69d3dc01ba72db60cae272ed206d2a4a8a3ea7d44df827402","observation_id":"fa8408ba-f25e-437a-be40-cbcce7a70f3d","resolution":{"observed_at":"2026-08-02T02:40:38.119936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:38.236474Z","title":"Hallucination reduction with casal: Contrastive activation steering for amortized learning.arXiv preprint arXiv:2510.02324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.236474Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:a60e77852183105e5d7d7b70e962f504a0fc2721f685e8922027d4630d8a787c","observation_id":"2f90c9b0-0516-4e52-a06c-b5a4630a2fb1","resolution":{"observed_at":"2026-08-02T02:40:38.236474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:38.358389Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.358389Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:27e248cbfb11a85b7d9d5a6dde77eae5cd02c93310eaf5818aed6506a8f80390","observation_id":"915d921a-4246-4d20-a916-2d19047ccf6c","resolution":{"observed_at":"2026-08-02T02:40:38.358389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:38.478432Z","title":"Controlling language and diffusion models by transporting activations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.478432Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:f8a06f6b79369a486556ef6c02b41615aa2790b94afdb6048c8ab8baacae8454","observation_id":"2a9430f9-f464-4ede-9c1f-b0526618a1af","resolution":{"observed_at":"2026-08-02T02:40:38.478432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:38.585122Z","title":"Low-rank sinkhorn factorization, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.585122Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:018326e0fc859c937cf05950c5905b79fddc769479b6a177ddbf794f42f9d803","observation_id":"9470cf52-499e-4ad6-9718-c0aad4b03fb3","resolution":{"observed_at":"2026-08-02T02:40:38.585122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:38.707927Z","title":"Interfacegan: Interpreting the disentangled face representation learned by gans.IEEE transactions on pattern analysis and machine intelligence, 44(4):2004–2018, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.707927Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:e05ed6285f1146e648321d151c1d425013233e15c2b287d28f7b37a5df68fe74","observation_id":"53c2017b-b7c2-4715-a759-e1921699240d","resolution":{"observed_at":"2026-08-02T02:40:38.707927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-02T02:40:38.837139Z","title":"Smolvla: A vision-language-action model for affordable and efficient robotics.arXiv preprint arXiv:2506.01844, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.837139Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:609cf2f809a24c9b5c62b3abf1b656777e681d399960c7fc27c02e7483c268cf","observation_id":"7bc26fef-90c7-4b4c-9023-cabe43107699","resolution":{"observed_at":"2026-08-02T02:40:38.837139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-02T02:40:38.956222Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:38.956222Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:2a11d36ee772a580e9d310107a358e4aa7c79560e0eb02684099a169af0a9a9f","observation_id":"2cbe06d8-5449-4b1f-a9d1-cc301832e0b9","resolution":{"observed_at":"2026-08-02T02:40:38.956222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-02T02:40:39.042605Z","title":"Steering language models with activation engineering.arXiv preprint arXiv:2308.10248, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:39.042605Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:dfdf64db8cf793693a154fd492f66b6fb77b10aaa6e5f92283f00f284eb5ac5d","observation_id":"4ec30ff9-62fd-46d4-abf1-c486d951e540","resolution":{"observed_at":"2026-08-02T02:40:39.042605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T02:40:39.080256Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:39.080256Z"},"links":{"citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:a3df02ae6fd65e94211a4eed013a4f1ba420972f3680d8564dc5f4b86f018ea4","observation_id":"831d7ae1-65ed-4614-aed4-582c51a15d9a","resolution":{"observed_at":"2026-08-02T02:40:39.080256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-02T02:40:39.162784Z","title":"Do this quickly","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T02:40:39.162784Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2607.14280"},"observation_digest":"sha256:a9da31c397ffefbdca15efc8db18d43cd4145c86cd6f78c46b6edb92aac642c0","observation_id":"a020e014-5f7f-4421-8563-51059d6b564c","resolution":{"observed_at":"2026-08-02T02:40:39.162784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.14280","last_updated":"2026-07-15T18:39:13Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T08:18:11.392198Z","submitted_at":"2026-07-15T18:39:13Z","title":"DiMaS: Distribution Matching for Steering Vision-Language-Action Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2607.14280."}