{"as_of":"2026-08-07T19:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d89b186f230d6fb0639a3ce98a5aeaf23e1186aa7ce255064b349c153c6cf76","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:21:35.386601Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11155/citation-record","integrity":"/paper/2507.11155/integrity","json":"/paper/2507.11155/citation-record.json","paper":"/paper/2507.11155"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.228064Z","title":"https://huggingface.co/deepseek-ai/ 13 DeepSeek-R1","venue":null,"work_id":"d64912fd-1a10-4215-815d-ab78cf58a9cb","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.122949Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:471f04abc9747e2d91fe0137002472b7b5fb3d3485b928b128682babd1fd38d4","observation_id":"de479335-37c3-4d7c-be41-782cef9fa42e","resolution":{"observed_at":"2026-08-06T17:21:36.236155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.199078Z","title":"https://openai.com/index/gpt-4-1/","venue":null,"work_id":"0de5476d-b410-4570-8b3f-da342627249c","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.127530Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:05c543e56972e24fd846c0728aacc9d1c67068c84914eecec2b03802bf4e1084","observation_id":"3845f66e-d594-4ce7-b367-fd4bae1e3fcd","resolution":{"observed_at":"2026-08-06T17:21:36.213411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.173481Z","title":"https://openai.com/research/gpt-4v- system-card","venue":null,"work_id":"e5180b0c-6214-4948-9ebf-6d69d249071b","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.132351Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:dea63426572e5c09bfb16f2316887ddee3670a01a465626129f75b68d2a3c255","observation_id":"2705751e-6dbd-4d2d-bf6d-25123558ba53","resolution":{"observed_at":"2026-08-06T17:21:36.185507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.149835Z","title":"https://huggingface.co/datasets/laion/ laion2B-en","venue":null,"work_id":"3cd774fe-f011-402c-95ec-35983e883433","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.136636Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:1c3051181ebd66e56380fd35f829e310dd8bf1bfb04960de19c4a2b87999e56c","observation_id":"62008d21-bb05-4e6a-b5c5-b5a8b18aa477","resolution":{"observed_at":"2026-08-06T17:21:36.160262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.118786Z","title":"https: //academictorrents.com/details/ 1cda9427784a6b77809f657e772814dc766b69f5","venue":null,"work_id":"a47b6c6e-10ff-402c-9930-f70fc62c6fb5","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.140805Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:c28d25fd8e3956776e16e6836aad0b048ff422cd25be18de1d931e4907f1fa45","observation_id":"dfb1bc55-ccb3-4378-a25f-0c5bbf95b529","resolution":{"observed_at":"2026-08-06T17:21:36.132459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.097177Z","title":"https://web.archive.org/web/ 20220406151527/https://labs.openai.com/policies/ content-policy","venue":null,"work_id":"5bc46a0c-f5ff-4009-8948-5d3d445af9a6","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.145036Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e248fdf14e49f752e033d1ef4f4c6f772c69f6a7fc71824a3b3b7a8a76f203b5","observation_id":"6ac9360b-cd54-4c35-bb10-ff6067519a5a","resolution":{"observed_at":"2026-08-06T17:21:36.106730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.076801Z","title":"https://openai.com/o1/","venue":null,"work_id":"2f6faae2-5efd-498e-b4a2-e36f29138a8e","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.148841Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:77355a358569c0c9c6ee5c5718747f97cda959b168fc2d079f10a91196421196","observation_id":"83110e28-ebbf-498a-82ea-25f343e7677a","resolution":{"observed_at":"2026-08-06T17:21:36.085062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.048685Z","title":"https://osf.io/2rqad/","venue":null,"work_id":"f0ca5268-289e-4c9f-842c-2d0716a400c2","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.152404Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:56b641b0b1a6ac83b278c1a9572a4b7b09b27ffbc3614cba336a334e42a88eeb","observation_id":"e450028e-a585-4add-9526-52bf0d21a505","resolution":{"observed_at":"2026-08-06T17:21:36.057871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T17:21:35.156208Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.156208Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2a77f5c374e5c627587a405a157cd3e710362a4fa725df2294d9f9083760154d","observation_id":"18bdc356-6edd-44ff-8389-a227cc205a27","resolution":{"observed_at":"2026-08-06T17:21:35.156208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.031217Z","title":"Designing Neural Network Architectures using Rein- forcement Learning","venue":null,"work_id":"ba0c49da-a034-47e2-9964-e97a04ee1b28","year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.159839Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e08f410167762e7bba335e210d5cb036e591fd09a548b74ac7d9ea5e3b229287","observation_id":"47a09fa3-174c-42c8-ba3d-c067bf6da595","resolution":{"observed_at":"2026-08-06T17:21:36.036711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:36.010777Z","title":"Image Safeguarding: Reasoning with Conditional Vision Language Model and Obfuscating Unsafe Content Counterfactually","venue":null,"work_id":"630625ab-dfaa-4ff2-b4f9-e94f23a6979d","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.163361Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d17fedaab286fefaeb26f7d4c7bcf39937cf95fc30bdeba81ee052534e22ce76","observation_id":"2c0199ff-0443-4701-9516-ef4c6ce22a61","resolution":{"observed_at":"2026-08-06T17:21:36.019184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17297","snapshot_observed_at":"2026-08-06T17:21:35.166750Z","title":"InternLM2 Technical Re- port","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.166750Z"},"links":{"cited_paper":"/paper/2403.17297","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:64e837dce2e33b6719284ee83dedd0272ae9d24eb9c2b296877a313b20b190fe","observation_id":"f4895b71-2732-4461-b5bc-b051b20bc177","resolution":{"observed_at":"2026-08-06T17:21:35.166750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12793","last_updated":"2023-11-28T08:52:50Z","snapshot_observed_at":"2026-08-04T08:17:54.774738Z","submitted_at":"2023-11-21T18:58:11Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12793","snapshot_observed_at":"2026-08-06T17:21:35.170826Z","title":"ShareGPT4V: Improving Large Multi-Modal Models with Better Captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.170826Z"},"links":{"cited_paper":"/paper/2311.12793","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:55126df7bb2aefbc3fcd62f3e6567b2d5ed5e4e31713dd25c24ee9a2fe63826f","observation_id":"abe12a9e-b13f-4f56-bd0c-71d1e175db75","resolution":{"observed_at":"2026-08-06T17:21:35.170826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.175318Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.175318Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:2b0d128c40482de2586ac88709ce2f2e70335894c252fcb9945bc73a94786a19","observation_id":"fd2e3fcc-0580-4157-94c0-15377cc20100","resolution":{"observed_at":"2026-08-06T17:21:35.175318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.992581Z","title":null,"venue":null,"work_id":"c7af7a9b-6a3a-4eb4-aed0-22f892363d24","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.179278Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:8803b280798df0db6f3d7e16aca0f0f85044cd7c67d30a950bd07e2b366cbd35","observation_id":"86f736ee-9392-4189-ae26-0823d40af63c","resolution":{"observed_at":"2026-08-06T17:21:35.997267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.979199Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":"e4a08da7-d097-4f9f-9dc3-22d504f5f392","year":2009},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.183752Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:55547b750c20777a700d68ae44bcdec449276326b8e30681783578e5f4cdf7c9","observation_id":"3e83941c-494d-48dd-8b6b-bae0b4bfcd27","resolution":{"observed_at":"2026-08-06T17:21:35.984232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06625","last_updated":"2025-02-10T05:47:27Z","snapshot_observed_at":"2026-07-06T19:30:13.003609Z","submitted_at":"2024-10-09T07:21:43Z","title":"ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06625","snapshot_observed_at":"2026-08-06T17:21:35.186888Z","title":"ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.186888Z"},"links":{"cited_paper":"/paper/2410.06625","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e8bc93b38fe34e677664b06e46891f1ad4d0f2186ba0cf7e1b2d64243329aeeb","observation_id":"46b7d000-77e8-41a7-a883-caccc8755ba0","resolution":{"observed_at":"2026-08-06T17:21:35.186888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16420","last_updated":"2024-01-29T18:59:02Z","snapshot_observed_at":"2026-08-05T03:42:54.599829Z","submitted_at":"2024-01-29T18:59:02Z","title":"InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16420","snapshot_observed_at":"2026-08-06T17:21:35.190481Z","title":"InternLM-XComposer2: Mastering Free- form Text-Image Composition and Comprehension in Vision- Language Large Model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.190481Z"},"links":{"cited_paper":"/paper/2401.16420","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:5f3e3c78debbc46e32d5c997265a20b9ffda2016c568d5cbaf0821a0f82cb249","observation_id":"c217dcee-af51-45ad-ac57-61bb58e5735b","resolution":{"observed_at":"2026-08-06T17:21:35.190481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09244","last_updated":"2024-08-16T23:59:29Z","snapshot_observed_at":"2026-08-06T16:36:51.551387Z","submitted_at":"2023-12-14T18:59:04Z","title":"Helping or Herding? Reward Model Ensembles Mitigate but do not Eliminate Reward Hacking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09244","snapshot_observed_at":"2026-08-06T17:21:35.194359Z","title":"Heller, Stephen Pfohl, Deepak Ramachandran, Pe- ter Shaw, and Jonathan Berant","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.194359Z"},"links":{"cited_paper":"/paper/2312.09244","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7d1cb1f2892224fba336019fa70df648d781d2d14941ac7832eb2ffd51defd46","observation_id":"1936df79-e57c-42bc-a82a-46f309452a11","resolution":{"observed_at":"2026-08-06T17:21:35.194359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.198149Z","title":"Fleiss’ kappa statistic without paradoxes","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.198149Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:495c4673eb3b86bb49fb1accd1944e8c2444f1274cef82553a8e6e4539497d29","observation_id":"23b65e5f-de48-450a-883e-a0c63e09addf","resolution":{"observed_at":"2026-08-06T17:21:35.198149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.202068Z","title":"Measuring Nominal Scale Agreement Among Many Raters","venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.202068Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:fdf6c5a2570904faeae29936a464bd3cfda8677e6e20d30ca819af174c6867cf","observation_id":"7de8e157-ab5d-4a0c-aaf3-bb59dcb0aaa9","resolution":{"observed_at":"2026-08-06T17:21:35.202068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-06T17:21:35.205357Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.205357Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:00ccb07fab4f7a7979c55dc357eb009ce0399f2730ddb22a1fe9bab01b1c5d5b","observation_id":"9d52d7e1-7c04-4e59-b9d1-d849e87e2b27","resolution":{"observed_at":"2026-08-06T17:21:35.205357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-06T17:21:35.208807Z","title":"Fig- Step: Jailbreaking Large Vision-language Models via Typo- graphic Visual Prompts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.208807Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f4545d61dd34fe716708d29e79e8f9fed7ae070d7ca9b489e6f68e25d8730242","observation_id":"d549b25a-4dac-4f19-9750-9debf0272fd8","resolution":{"observed_at":"2026-08-06T17:21:35.208807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.954081Z","title":"Kwok, and Yu Zhang","venue":null,"work_id":"4051b47c-f238-4e4e-8b7e-75fba6d1bc5b","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.212605Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:9691cfd52602759f96783e1b9e63fac5ea423d6e1fa965c6e2b07221ee116bc8","observation_id":"dc3de447-b1b9-46ac-9c95-d0bd99d06b01","resolution":{"observed_at":"2026-08-06T17:21:35.958067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.943643Z","title":"Moderating Illicit Online Image Promo- tion for Unsafe User-Generated Content Games Using Large Vision-Language Models","venue":null,"work_id":"61e398b0-56c3-4c14-8985-5acf1c644cfe","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.215937Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:5acd1203f8e88d2c293dace8fdaea5ba2d9a78c709c30cb05ea6f3b209a40336","observation_id":"dd154da8-3727-42be-82e9-396a68385a9b","resolution":{"observed_at":"2026-08-06T17:21:35.947447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05113","last_updated":"2025-06-06T17:08:12Z","snapshot_observed_at":"2026-08-06T15:48:59.504311Z","submitted_at":"2024-06-07T17:44:32Z","title":"LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05113","snapshot_observed_at":"2026-08-06T17:21:35.219871Z","title":"LLavaGuard: VLM-based Safeguards for Vision Dataset Curation and Safety Assess- ment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.219871Z"},"links":{"cited_paper":"/paper/2406.05113","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:9da44c14bbbc4e6f91149705a8673df7a0a70dde9a1fa3d2dcff503ed0adf25b","observation_id":"fafedff1-86aa-4ec7-a2ca-2309d30b53ac","resolution":{"observed_at":"2026-08-06T17:21:35.219871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.932719Z","title":"Glass, Akash Srivastava, and Pulkit Agrawal","venue":null,"work_id":"e2f2ca4a-db7a-4cba-b76f-93fbba1d7d8e","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.224106Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e3e9fb0a6e5f80beaf7a67844f97dac13ef84947abf0b3059821497333b6dc40","observation_id":"fe8159af-8419-41c0-b7a7-1a5e90c57591","resolution":{"observed_at":"2026-08-06T17:21:35.936855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.921288Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen- Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"24dd2b92-eecc-4ff4-b652-c252671384a7","year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.227446Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7e5ed5aa03a62c507ee8416d2e573c3dc2090cb536d36ea48146c2e0da6144a3","observation_id":"c9250c89-11de-428e-a8f1-c7800e71b84c","resolution":{"observed_at":"2026-08-06T17:21:35.925456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.911253Z","title":"Deep Reinforcement Learning for Di- alogue Generation","venue":null,"work_id":"70fb9f2a-da07-4d8a-8b30-b194f0a5a069","year":2016},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.231261Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:a185add9c43e3b8daaf346443e89030839ad969f276e615769c017a612912532","observation_id":"a18f95d8-9b31-4586-a393-65111424bd3d","resolution":{"observed_at":"2026-08-06T17:21:35.915021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12086","last_updated":"2022-02-15T05:43:32Z","snapshot_observed_at":"2026-08-02T08:01:43.194717Z","submitted_at":"2022-01-28T12:49:48Z","title":"BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12086","snapshot_observed_at":"2026-08-06T17:21:35.235072Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.235072Z"},"links":{"cited_paper":"/paper/2201.12086","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:bf6d60a09dae442aa50d928943fb9512df985e065348f62230623a0498709745","observation_id":"438ccd36-c875-413f-a23b-e4f14297bd45","resolution":{"observed_at":"2026-08-06T17:21:35.235072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10665","last_updated":"2023-12-17T09:44:27Z","snapshot_observed_at":"2026-07-06T17:04:13.625458Z","submitted_at":"2023-12-17T09:44:27Z","title":"Silkie: Preference Distillation for Large Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10665","snapshot_observed_at":"2026-08-06T17:21:35.238949Z","title":"Silkie: Preference Distillation for Large Visual Lan- guage Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.238949Z"},"links":{"cited_paper":"/paper/2312.10665","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:031a8a1919ea51b1421d9d071f6c189e66dfab9ebcdbabb1a951f4e166b33300","observation_id":"197ee628-b76b-4860-9504-86827db0aa01","resolution":{"observed_at":"2026-08-06T17:21:35.238949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.901003Z","title":"Red Teaming Visual Language Models","venue":null,"work_id":"af315fc4-7c2c-4910-93ed-9f08c49c610f","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.242675Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e406ee0ddfeb97e63be512afb0e718c271ec451d41756b77f3cb933ef245960a","observation_id":"bea15e90-d2cf-4593-adcf-9b1e5939ef22","resolution":{"observed_at":"2026-08-06T17:21:35.904973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01523","last_updated":"2025-02-28T15:13:46Z","snapshot_observed_at":"2026-08-06T08:17:48.022382Z","submitted_at":"2024-01-03T03:28:55Z","title":"GOAT-Bench: Safety Insights to Large Multimodal Models through Meme-Based Social Abuse","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01523","snapshot_observed_at":"2026-08-06T17:21:35.246231Z","title":"GOAT-Bench: Safety Insights to Large Multi- modal Models through Meme-Based Social Abuse","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.246231Z"},"links":{"cited_paper":"/paper/2401.01523","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:8781d50796a64925c28337c7fd0dc6d1a44390f1929a447a36085be791f51107","observation_id":"9a707ee9-00d6-4970-a3c2-35751f12fba4","resolution":{"observed_at":"2026-08-06T17:21:35.246231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.888731Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C","venue":null,"work_id":"3e55c142-55ba-4607-be3a-c7dea353ca3c","year":2014},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.250252Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:69285dab42d56729b1edff2eb0fcb5ed4813e9cf3a16bdf08a61cc82521ab3d7","observation_id":"3e7297ca-769d-49f1-9d06-003aa41fe1be","resolution":{"observed_at":"2026-08-06T17:21:35.893067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03744","last_updated":"2024-05-15T19:22:44Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:59:56Z","title":"Improved Baselines with Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03744","snapshot_observed_at":"2026-08-06T17:21:35.254512Z","title":"Improved Baselines with Visual Instruction Tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.254512Z"},"links":{"cited_paper":"/paper/2310.03744","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:ca1b74ba7105d2b453cb178f9777f59c88d81c17444214a7867aa863d3827e83","observation_id":"b1f2be79-c6f2-4023-bd69-e7bf4bd24fca","resolution":{"observed_at":"2026-08-06T17:21:35.254512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.876351Z","title":"Visual Instruction Tuning","venue":null,"work_id":"7c69f9a7-0a3a-4dc0-9a78-a90d226a52cd","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.258141Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:16d49796cd8293287111680d6ce8e0765b65bdd336dc9977cc0973d3c0ecf649","observation_id":"fca06dda-adac-42f5-a31c-5adfe6756e1f","resolution":{"observed_at":"2026-08-06T17:21:35.880351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09047","last_updated":"2024-10-11T17:59:31Z","snapshot_observed_at":"2026-07-06T19:31:57.906994Z","submitted_at":"2024-10-11T17:59:31Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09047","snapshot_observed_at":"2026-08-06T17:21:35.262536Z","title":"Unraveling and Mitigating Safety Alignment Degradation of Vision-Language Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.262536Z"},"links":{"cited_paper":"/paper/2410.09047","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f58359ae82cb818cf351d2c21fd5c6ee318f70cb9a7d16659863a758a64a49e4","observation_id":"2faa3e67-f4e6-46ee-85f4-9463ca6e7bcf","resolution":{"observed_at":"2026-08-06T17:21:35.262536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.865937Z","title":"MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models","venue":null,"work_id":"822ed617-f495-48f8-9cf0-e8a8447cb427","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.266120Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:19da825b8c99be4d5f6b6afa36122a69defb03ba89a5c3bdab5caea9e9b4b726","observation_id":"5e894b5c-b5e4-4f10-99a8-b270c72bb9e9","resolution":{"observed_at":"2026-08-06T17:21:35.869284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T17:21:35.269179Z","title":"RoBERTa: A Robustly Opti- mized BERT Pretraining Approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.269179Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:16e9e5c9bc530203a1b1b03e228a2c30c89e056f4ccfc2f8825c62dddcec75b2","observation_id":"f03aac4f-842b-40ae-84fa-8b4b78a6425d","resolution":{"observed_at":"2026-08-06T17:21:35.269179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13581","last_updated":"2024-05-22T12:21:27Z","snapshot_observed_at":"2026-08-07T15:03:51.692003Z","submitted_at":"2024-05-22T12:21:27Z","title":"Safety Alignment for Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13581","snapshot_observed_at":"2026-08-06T17:21:35.272675Z","title":"Safety Alignment for Vision Language Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.272675Z"},"links":{"cited_paper":"/paper/2405.13581","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:24c1d4934c7887ce01eef36f6464266147356d68e4369e6f018573bb0bb0af53","observation_id":"3acacffc-bf8e-4d23-8f7e-673730b424ca","resolution":{"observed_at":"2026-08-06T17:21:35.272675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.854532Z","title":"From Meme to Threat: On the Hateful Meme Understanding and Induced Hateful Content Generation in Open-Source Vision Language Mod- els","venue":null,"work_id":"55791a8c-f24d-4892-86e4-7997bba99f9d","year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.276398Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b722e37a57a00a06e26aac5ef4fb8e2e42078ebb8cbc65618a5e0529795e168e","observation_id":"a56f1111-94f5-472d-912c-ff112a1ca5a0","resolution":{"observed_at":"2026-08-06T17:21:35.858852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.844496Z","title":null,"venue":null,"work_id":"5760cd38-62a5-4209-a551-5e5c47eec97a","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.279490Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f6d2b72bdad761e19f518ecc5f4380e5118ece76dcf25c81d45743147657287a","observation_id":"4e622c8d-4a8c-4177-b087-afdfaef88c04","resolution":{"observed_at":"2026-08-06T17:21:35.847374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T17:21:35.282837Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.282837Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:dfa045ca5c7bd2e26a7ce54c4f48dbd35e1d04067544b37d8a39e5f44fa7a0f9","observation_id":"50bc509b-1ddb-4157-850f-f19e99d996b9","resolution":{"observed_at":"2026-08-06T17:21:35.282837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.834969Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":"bb958a9d-885f-44bb-bba9-2b74a88adaf6","year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.286650Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b7f246740866b35a5b160ce00cd75845480b297c6a05731b26bc1a3280dc4f19","observation_id":"aa6b75b0-5afb-4771-8d0d-446cfaead8b1","resolution":{"observed_at":"2026-08-06T17:21:35.837911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13213","last_updated":"2023-08-16T22:38:55Z","snapshot_observed_at":"2026-07-06T15:45:47.517122Z","submitted_at":"2023-06-22T22:13:03Z","title":"Visual Adversarial Examples Jailbreak Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13213","snapshot_observed_at":"2026-08-06T17:21:35.290281Z","title":"Visual Adversarial Examples Jail- break Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.290281Z"},"links":{"cited_paper":"/paper/2306.13213","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b39e36b86708b16d877025530ab2a9fd323721204d2aa8adabf8fc9bca9bde79","observation_id":"b1632b72-81db-4f0f-861a-6e8f9ece354b","resolution":{"observed_at":"2026-08-06T17:21:35.290281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.821971Z","title":"On the Evolution of (Hateful) Memes by Means of Multimodal Contrastive Learn- ing","venue":null,"work_id":"d3eb30d7-5af6-40a0-8358-fa40f414e42a","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.293978Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f8dbcc550959f40844dae61885ce580447c918abc8e7079b2ac5affe7978a0f0","observation_id":"f67fa2e5-384f-4cc9-a0f4-9d271e4a1de4","resolution":{"observed_at":"2026-08-06T17:21:35.828089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.809817Z","title":"Unsafe Diffusion: On the Gen- eration of Unsafe Images and Hateful Memes From Text-To- Image Models","venue":null,"work_id":"37f643a6-76d8-4cb7-848d-5e70d7ff406c","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.297189Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:82af99fa3cc700da2fd7ae97fbb01c365a52e9003a74ae7c0a8f0bff738f7bcf","observation_id":"011ea5f8-e16b-47fa-8bdd-fe77222e103f","resolution":{"observed_at":"2026-08-06T17:21:35.814657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03486","last_updated":"2025-09-11T08:50:08Z","snapshot_observed_at":"2026-08-04T06:06:53.556065Z","submitted_at":"2024-05-06T13:57:03Z","title":"UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03486","snapshot_observed_at":"2026-08-06T17:21:35.300886Z","title":"UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Im- ages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.300886Z"},"links":{"cited_paper":"/paper/2405.03486","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:22a559ef4820a7d8b9b6ff02df661f4cfadc1712f3b1a209f34581ab4e17510f","observation_id":"1aa2458a-4eb7-4ac5-8c6b-f652f18bcc17","resolution":{"observed_at":"2026-08-06T17:21:35.300886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.797556Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":"dae2d0da-4a96-4e19-861b-858362f392f9","year":2021},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.304263Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:e0b1413985a3c14dea72083975dcec77986902a47ccbd00d7c21a49a43f918b4","observation_id":"da40a24f-6f79-47c9-8e59-5fcf662f07cf","resolution":{"observed_at":"2026-08-06T17:21:35.802346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.785484Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"7d90e6af-4961-4344-a299-64b16c69b471","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.307529Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:1e8ecdb3315b6b9e2cad8da8894b902bc7fd5c7a54b149eac189ef5e74bb000c","observation_id":"786f692e-4762-405e-8cda-7178cee67106","resolution":{"observed_at":"2026-08-06T17:21:35.789689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12198","last_updated":"2025-03-23T04:26:00Z","snapshot_observed_at":"2026-07-06T17:32:15.447061Z","submitted_at":"2024-02-19T15:03:04Z","title":"Exploring the Limits of Zero Shot Vision Language Models for Hate Meme Detection: The Vulnerabilities and their Interpretations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12198","snapshot_observed_at":"2026-08-06T17:21:35.311066Z","title":"Zero shot VLMs for hate meme detection: Are we there yet? CoRR abs/2402.12198, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.311066Z"},"links":{"cited_paper":"/paper/2402.12198","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d13f62b7cc8ace7f92e7b47a22e313eaec76cb672c0416bf0f600c57cb4b67dc","observation_id":"4c5e82af-a94f-420a-b7a3-d07d305c1978","resolution":{"observed_at":"2026-08-06T17:21:35.311066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05105","last_updated":"2023-04-26T11:47:44Z","snapshot_observed_at":"2026-07-06T14:16:24.882622Z","submitted_at":"2022-11-09T18:54:25Z","title":"Safe Latent Diffusion: Mitigating Inappropriate Degeneration in Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05105","snapshot_observed_at":"2026-08-06T17:21:35.315436Z","title":"Safe Latent Diffusion: Mitigating In- appropriate Degeneration in Diffusion Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.315436Z"},"links":{"cited_paper":"/paper/2211.05105","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:f6de3995849da6e17fef590219a5488382c25e29efb4e02b0173ff5184841886","observation_id":"c35be7c9-a6dd-4902-bcbc-86d09efac4a2","resolution":{"observed_at":"2026-08-06T17:21:35.315436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T17:21:35.319076Z","title":"Proximal Policy Optimization Algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.319076Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:19a04c0c729f71a0285a35bf79a712a40c0f4feb86f9bf7577fc0e579edaab0c","observation_id":"3bb4527a-5233-4b6a-b959-237078f85288","resolution":{"observed_at":"2026-08-06T17:21:35.319076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.322406Z","title":"HateBench: Benchmarking Hate Speech Detectors on LLM-Generated Content and Hate Cam- paigns","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.322406Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:892727e0140c815689ab8527f7d7103f2c77b991a2859c42f0601484821f9c9d","observation_id":"197ef339-8d22-4290-808f-3a0a717836ca","resolution":{"observed_at":"2026-08-06T17:21:35.322406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17830","last_updated":"2024-03-26T16:10:21Z","snapshot_observed_at":"2026-07-06T17:51:24.261505Z","submitted_at":"2024-03-26T16:10:21Z","title":"Assessment of Multimodal Large Language Models in Alignment with Human Values","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17830","snapshot_observed_at":"2026-08-06T17:21:35.326106Z","title":"Assessment of Multimodal Large Language Mod- els in Alignment with Human Values","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.326106Z"},"links":{"cited_paper":"/paper/2403.17830","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:b37d3e4e6d8d44763b81e6d321a426aebbe8cf28e1956d6ddaf6653a308c5216","observation_id":"3bfa66ed-6201-4f70-81cc-6ee2ef44e5e6","resolution":{"observed_at":"2026-08-06T17:21:35.326106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.764729Z","title":null,"venue":null,"work_id":"9b408171-c07b-4916-b360-e287d645415a","year":2022},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.329648Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:ef07e4455ec2ff3e4c5df84365d3c1b54c2689796ae9c4c3599d75466509d437","observation_id":"f67551d3-b7b4-40ee-bf94-4af4e4236075","resolution":{"observed_at":"2026-08-06T17:21:35.768524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.752524Z","title":"Align- ing Large Multimodal Models with Factually Augmented RLHF","venue":null,"work_id":"f5375e73-74da-4f33-becf-a850f1280b9e","year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.333883Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:ec72b4ae971badb27871f45e77d8867bf47e6283e96b1627a3c51e2451fbc3eb","observation_id":"fbd7e762-aab8-4f8d-a33f-cc4ad88a93c9","resolution":{"observed_at":"2026-08-06T17:21:35.757327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.740537Z","title":"Vicuna: An Open-Source Chatbot Impress- ing GPT-4 with 90%* ChatGPT Quality","venue":null,"work_id":"6f0125c2-0d20-4dd3-ad8e-e3260e7fd23d","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.337460Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:53205c625a08774c9f1710dcba877ec9f4118a1c171367da2ce410e7f6f4ded6","observation_id":"cfb9e0df-b385-4594-a38f-b907dc1c8ccb","resolution":{"observed_at":"2026-08-06T17:21:35.745048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T17:21:35.340516Z","title":"Qwen2-VL: Enhancing Vision-Language Model’s Perception of the World at Any Resolution.CoRR abs/2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.340516Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:d3b27ac9845c648a4b96669e8fb2a1026143b913f5820993a66bdc39a47c923e","observation_id":"d5218bbb-8a69-4f89-a888-3092290f110f","resolution":{"observed_at":"2026-08-06T17:21:35.340516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15279","last_updated":"2025-02-17T03:38:42Z","snapshot_observed_at":"2026-08-03T17:57:32.495715Z","submitted_at":"2024-06-21T16:14:15Z","title":"Safe Inputs but Unsafe Output: Benchmarking Cross-modality Safety Alignment of Large Vision-Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15279","snapshot_observed_at":"2026-08-06T17:21:35.344438Z","title":"Cross-Modality Safety Alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.344438Z"},"links":{"cited_paper":"/paper/2406.15279","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:3d27758c299b06a46c2b5fb8fdc4102d92180b2f43c1ee3d2d49cde793263cdf","observation_id":"0e60edac-3f2c-4201-8a5d-126e1d465497","resolution":{"observed_at":"2026-08-06T17:21:35.344438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-08-06T17:21:35.347771Z","title":"CogVLM: Visual Expert for Pretrained Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.347771Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:6529404079b11532bae9ca78a125150c679d5a5cf5ed0dc5a8b43a87c35256f6","observation_id":"d4c365a7-aa0e-4201-a726-517095b23028","resolution":{"observed_at":"2026-08-06T17:21:35.347771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.728980Z","title":"RL-VLM-F: Rein- forcement Learning from Vision Language Foundation Model Feedback","venue":null,"work_id":"36a5c163-47c0-479a-a679-1ae5467d5efa","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.351460Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:3ef1af1c780bd3c9fadcd033343bd18a23edcd34dc8c516678d429e6cb860816","observation_id":"b74250c5-fcb7-4e9e-bac2-d0389d5afa0d","resolution":{"observed_at":"2026-08-06T17:21:35.733568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20370","last_updated":"2024-09-30T15:06:53Z","snapshot_observed_at":"2026-07-06T19:24:35.007698Z","submitted_at":"2024-09-30T15:06:53Z","title":"The Perfect Blend: Redefining RLHF with Mixture of Judges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20370","snapshot_observed_at":"2026-08-06T17:21:35.355204Z","title":"The Perfect Blend: Redefining RLHF with Mixture of Judges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.355204Z"},"links":{"cited_paper":"/paper/2409.20370","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:dcd10959ae95c7298609c6b96af939d0660b66b992027b3b3987973e2c5159f0","observation_id":"b90fd3dc-1854-450a-b2cc-e1efdc81e7d4","resolution":{"observed_at":"2026-08-06T17:21:35.355204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-06T17:21:35.359327Z","title":"Qwen2 Technical Re- port","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.359327Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:06410ee1dcbfe2c24585f5e606192ce1b5a866106a6753b2ea93c6e1c5c26feb","observation_id":"51af121b-4754-4101-9dfd-43e10568370e","resolution":{"observed_at":"2026-08-06T17:21:35.359327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13797","last_updated":"2025-05-18T16:13:47Z","snapshot_observed_at":"2026-07-06T17:47:51.284226Z","submitted_at":"2024-03-20T17:54:58Z","title":"Bridge the Modality and Capability Gaps in Vision-Language Model Selection","version":3},"cited_work":{"arxiv_id":"2403.13797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13797","snapshot_observed_at":"2026-08-06T17:21:35.443194Z","title":"Bridge the Modality and Capability Gaps in Vision-Language Model Selection","venue":"cs.LG","work_id":"5bddf432-94e2-47cc-8e3b-21b67f7d2698","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.363566Z"},"links":{"cited_paper":"/paper/2403.13797","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:1dca065b43fa8f16d74e8e607810087f5407280fa0607f965484f933ea9294b2","observation_id":"be4f0882-b600-49f2-afe0-ca71eed6ddc9","resolution":{"observed_at":"2026-08-06T17:21:35.449506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.716529Z","title":"RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-Grained Correctional Human Feedback","venue":null,"work_id":"6d6f8a9e-1a4c-427a-8c92-08012ee1138b","year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.367388Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:289387ffbbd5eb3a91fee2aec1e7d0998a11be5e07f9bb799efe3917a3cf4368","observation_id":"2118bebf-d9d8-4211-99e4-9b19d984e47d","resolution":{"observed_at":"2026-08-06T17:21:35.721254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-05T06:50:37.512438Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-06T17:21:35.371849Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vi- sion Language Model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.371849Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:47fee3f0c6582d4c50df9589e71d0cddfd8104615774aa40232f49a2ba1df685","observation_id":"ffc2c45d-0465-46fb-a516-7373399e78f1","resolution":{"observed_at":"2026-08-06T17:21:35.371849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03225","last_updated":"2025-04-09T17:25:07Z","snapshot_observed_at":"2026-07-06T20:17:15.995064Z","submitted_at":"2025-01-06T18:57:31Z","title":"Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03225","snapshot_observed_at":"2026-08-06T17:21:35.375340Z","title":"Automated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.375340Z"},"links":{"cited_paper":"/paper/2501.03225","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:0726af7b3552e963cbfeca036e8276733377c2921a8d446ac9c2c895249ceeb3","observation_id":"4b83a515-e482-4667-93b7-ce63f42bb000","resolution":{"observed_at":"2026-08-06T17:21:35.375340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.705507Z","title":"On Evaluating Ad- versarial Robustness of Large Vision-Language Models","venue":null,"work_id":"9e56c8bf-0cab-42fc-8936-f779d9cbad2e","year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.378803Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:1e8038ede762fa7f0cd67b89e9a9ad822de115d275f2ae5dcfec68491ccd65e1","observation_id":"641d9c1f-33ee-4821-a3c0-9a6db5d9a12c","resolution":{"observed_at":"2026-08-06T17:21:35.709325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04964","last_updated":"2023-07-18T08:44:47Z","snapshot_observed_at":"2026-08-07T18:08:01.409989Z","submitted_at":"2023-07-11T01:55:24Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04964","snapshot_observed_at":"2026-08-06T17:21:35.382133Z","title":"Secrets of RLHF in Large Language Models Part I: PPO","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.382133Z"},"links":{"cited_paper":"/paper/2307.04964","citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:c63e3f76e1d6625ffb8bd0842325df28a42b3432d6540b40d54079e4521b80df","observation_id":"2c76d47f-024e-451e-a568-db48a2677b97","resolution":{"observed_at":"2026-08-06T17:21:35.382133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:21:35.693692Z","title":"Yes” or “No","venue":null,"work_id":"b21e886b-f510-48ad-a3eb-f5ff89f209cb","year":2018},"citing_paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:35.386601Z"},"links":{"citing_paper":"/paper/2507.11155"},"observation_digest":"sha256:7a31b13df4aa86ac1d31c7f27f5c6239086b4d996115e11a61f231503590db8e","observation_id":"e19ae674-5361-406b-b663-9a91ebdf934b","resolution":{"observed_at":"2026-08-06T17:21:35.697292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11155","last_updated":"2025-07-15T10:04:27Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T17:12:51.246126Z","submitted_at":"2025-07-15T10:04:27Z","title":"Bridging the Gap in Vision Language Models in Identifying Unsafe Concepts Across Modalities"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2507.11155."}