{"as_of":"2026-08-16T22:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:99133ec6d954864b8da54c15a01369f930ca81ee93fc306f09a7bf3105bf960b","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:35:59.503310Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.08804/citation-record","integrity":"/paper/2505.08804/integrity","json":"/paper/2505.08804/citation-record.json","paper":"/paper/2505.08804"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.125087Z","title":"Anonymized Repository - Anonymous GitHub","venue":null,"work_id":"a23ad818-2e03-4e49-9f32-86c580abff0b","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.329611Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:679ead6b6e2205b2017070cff66d7d45b0b9525aeca25baf84f839a9e05fbda3","observation_id":"6b1a3136-0a37-49fd-81e3-8df4f9d25b6c","resolution":{"observed_at":"2026-08-15T22:36:00.129594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.333927Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.333927Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:717bdb1aa6d08b24cec97f09401f8f01e0942a7417446113b12b0a122827af86","observation_id":"b0db5a2d-4970-4b97-b1a8-9f3440603d0a","resolution":{"observed_at":"2026-08-15T22:35:59.333927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-15T22:35:59.337905Z","title":"Hierarchical text-conditional image generation with clip latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.337905Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:553aecfdb09957bf66f594677c490fcbc82afc9f3a44bb9a21223c76c4cad7a5","observation_id":"65cf6177-5cdb-488b-b62e-c9a4e6787edc","resolution":{"observed_at":"2026-08-15T22:35:59.337905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.103831Z","title":"Lexica: Search, Discover & Create 5M+ AI-Generated Images","venue":null,"work_id":"294a2854-bc47-4f66-958a-0569233f3c19","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.342118Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:dbb31a20de53c182269a86c3e5f26901ec2cbabd097ff255f019c58a94aebdc8","observation_id":"a97fa4ba-ebc4-4029-b207-929b6a9aaba6","resolution":{"observed_at":"2026-08-15T22:36:00.108516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.346188Z","title":"Imagic: Text-based real image editing with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.346188Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:5aa66dac300a80cf3dda3d7175279e5b252469b8f4624a837645dbcd4634d684","observation_id":"5fbd5225-407e-4d19-9b45-cd46fb75187e","resolution":{"observed_at":"2026-08-15T22:35:59.346188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.349951Z","title":"Sine: Single image editing with text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.349951Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:7be509f5dbf90791db779d6cedeca4b9ec57f71c2ee0a971a1415dd1549c8668","observation_id":"5db67f92-dd76-41c5-9727-27b971fb5111","resolution":{"observed_at":"2026-08-15T22:35:59.349951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-15T22:35:59.354162Z","title":"An image is worth one word: Person- alizing text-to-image generation using textual inversion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.354162Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:ac26f0b9a2b46c30c64fdf17fd9f8f4d0cf063a21f6ea550518842e205fec50e","observation_id":"121c7575-eb8c-40f4-b26d-fd83f1aeb956","resolution":{"observed_at":"2026-08-15T22:35:59.354162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.358966Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.358966Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:6999c3c143b23aee512afe7b1dba5d66673ac8a010931c41314189087fc0250e","observation_id":"6cd841b4-8803-4811-8f4f-9aa4bd4d5202","resolution":{"observed_at":"2026-08-15T22:35:59.358966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.063161Z","title":"Artificial intelligence is creating images of child sex abuse. it’s horrific — and a challenge to stop","venue":null,"work_id":"22796b32-f2c0-46e4-b68d-96ad97c5f93a","year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.362865Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:0266428555f339cc579f4e4a669ad1ed5e7536f78db99a2a8ef02c10fdb8671c","observation_id":"3fc83b46-b29c-4455-a387-0286beb8dd92","resolution":{"observed_at":"2026-08-15T22:36:00.067602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.048707Z","title":"Arrest over ai-generated child sexual abuse material sparks concerns about technology’s darker uses,","venue":null,"work_id":"a09aaf8b-016e-4bfb-90a6-e998067c87cd","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.366259Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:45e78497b3834cfe7d3a7f10c322b00ff3f570ef7223cbddcabd9e3dca21160b","observation_id":"c947574d-b4a2-4207-a19f-cbcd3dda2f5b","resolution":{"observed_at":"2026-08-15T22:36:00.053969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.031553Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models,","venue":null,"work_id":"e659e7ad-8b0b-497a-990a-8fbc24cce285","year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.369931Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:1ce6941893208dbb77c7b80babc35fdcbb7424a922cadffd256f691d969ab4b4","observation_id":"4e15d289-a868-4fe8-9ba3-e48c48eec9e7","resolution":{"observed_at":"2026-08-15T22:36:00.038532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04610","last_updated":"2022-11-10T10:07:37Z","snapshot_observed_at":"2026-08-16T16:27:19.710410Z","submitted_at":"2022-10-03T14:04:46Z","title":"Red-Teaming the Stable Diffusion Safety Filter","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04610","snapshot_observed_at":"2026-08-15T22:35:59.373832Z","title":"Red-teaming the stable diffusion safety filter,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.373832Z"},"links":{"cited_paper":"/paper/2210.04610","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:60861757c8f8325e31d0a5740c9978a09b7593177c3ec29502bcd452df71756f","observation_id":"14e16d2d-ccb8-49b0-9f97-82397e83e23b","resolution":{"observed_at":"2026-08-15T22:35:59.373832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:36:00.003901Z","title":"Sneakyprompt: Jailbreaking text-to-image generative models,","venue":null,"work_id":"d702190f-fc55-467b-8339-df4b18ee9b7e","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.377747Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:fd05ae3f24ca45d1b79d9bbb794aeac8f2fd0fb1936a73e6f4c22d690ddbc01b","observation_id":"72fb4c36-80e0-4186-b535-6f4076987de7","resolution":{"observed_at":"2026-08-15T22:36:00.014494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14122","last_updated":"2024-10-17T03:34:21Z","snapshot_observed_at":"2026-08-16T14:57:52.542004Z","submitted_at":"2023-09-25T13:20:15Z","title":"SurrogatePrompt: Bypassing the Safety Filter of Text-to-Image Models via Substitution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14122","snapshot_observed_at":"2026-08-15T22:35:59.381565Z","title":"Surrogateprompt: Bypassing the safety filter of text-to-image models via substitution,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.381565Z"},"links":{"cited_paper":"/paper/2309.14122","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:bd6e5ca43302bd224f0632fe2fa88b54caa941d8438790412fa69d21cac3e963","observation_id":"83b4289b-bb55-4647-9cc3-a9fb374fec2b","resolution":{"observed_at":"2026-08-15T22:35:59.381565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.990333Z","title":"Latent imitator: Generating natural individual discriminatory instances for black-box fairness testing,","venue":null,"work_id":"7197d4cb-c9de-41f8-9bd9-dc2134c7e855","year":2023},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.385886Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:7e1c323a18e952c178870b704dd52de492b9feb26e1b4337281df13477c9f610","observation_id":"9be1e3d1-54c1-4563-8823-4e65e700b68d","resolution":{"observed_at":"2026-08-15T22:35:59.994395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.389441Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.389441Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:29e6d245a06b210ff3ab3b0192ecf033de004e6ae0f225fde34dd3385c0b4d15","observation_id":"259de28c-9fff-4b83-81a3-fd65e5fbd082","resolution":{"observed_at":"2026-08-15T22:35:59.389441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.971597Z","title":"CompVis/stable-diffusion-v1-4 · Hugging Face","venue":null,"work_id":"c2f2dce0-d774-4a02-b2e6-eca4d8655abe","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.393103Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:90e024cb5036f696f4b4c91d7d61724a2e1347266b6d61a4bd30f6998a2e1402","observation_id":"7402dc45-c009-4030-ab1e-da4b4bc2471b","resolution":{"observed_at":"2026-08-15T22:35:59.975672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.960368Z","title":"Free AI Art Generator, AI Art Maker|Stable Diffusion Online","venue":null,"work_id":"26c76279-8211-42e4-b386-9852ac7e8854","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.396916Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:4e37f19a65522d67a5a3b99c2894036d90d049af4c60596e892150625f13a6e3","observation_id":"63425746-f3f6-451b-a6a4-1643d494c783","resolution":{"observed_at":"2026-08-15T22:35:59.964443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.948776Z","title":"bdsqlsz/stable-diffusion-v1-5 · Hugging Face","venue":null,"work_id":"af216238-5c40-4aa5-bc6c-9a608cae98e4","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.401347Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:dcb0d17d0d63aee98d9a8ddcac5dd1cb7f33cdc9f794c629b0fd189896a9bbe8","observation_id":"81a386e3-55a4-4d34-8ab5-f60a848d7717","resolution":{"observed_at":"2026-08-15T22:35:59.952760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.936974Z","title":"Available: https://4chan.org/","venue":null,"work_id":"76f868cb-15f6-4c5d-9019-f853c8c05e72","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.405392Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:c8d82517650534a7f9c528c4302bc3437ca296fd7113c1ca3f8d559b4eaac3e3","observation_id":"d88f58d2-9102-489a-add4-a2c203e02465","resolution":{"observed_at":"2026-08-15T22:35:59.941076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"articles/6338764","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.643451Z","title":"Are there any restrictions to how I can use DALL·E 2?","venue":null,"work_id":"b5a8723d-cca8-4d1c-8118-890a5c456e52","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.409289Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:91db13b16aed70852a79f715ee7de957c25756ff050750990077f6f81cd2d4c7","observation_id":"6d625c09-c81f-43e7-b6db-545ac294f78d","resolution":{"observed_at":"2026-08-15T22:35:59.650452Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.925255Z","title":"NsfwGPT: ’THAT’ NSFW prompt","venue":null,"work_id":"a08cdd9e-0501-4e4c-9d85-f875bbcc99d4","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.412739Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:1a8e6f2cf5bfae90c646e6f3b6a5e13dda746ad10f15c80955b3310ab3aadacd","observation_id":"283fbb66-6920-4315-b309-a568f5e29d23","resolution":{"observed_at":"2026-08-15T22:35:59.929402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.898879Z","title":"michellejieli/NSFW text classifier · Hugging Face","venue":null,"work_id":"3467d4a7-ffcb-4e59-b589-55ce56939321","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.419922Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:474327bd5855aa3839aaae085daf8155a4b78d017d1793fc91f7ff9deaedace9","observation_id":"f8fb21b6-c8f7-4dc6-95bf-4c544ddc6a72","resolution":{"observed_at":"2026-08-15T22:35:59.903380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.886625Z","title":"NSFW-Words-List/nsfw list.txt at master · rrgeorge- pdcontributions/NSFW-Words-List","venue":null,"work_id":"5a7e5299-e041-4bf3-b5c6-6d84f3577b50","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.423381Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:83cfdf4c5daf8318b51c603d4b0ccfd3306a7485e06f8dbdc60523f438afbbc4","observation_id":"fcf4e10b-31a2-4440-87d4-231571a7c25e","resolution":{"observed_at":"2026-08-15T22:35:59.890525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-15T22:35:59.427202Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.427202Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:16cc42f98c3c08278ff6cc98a9c5c34a8b9ee22c0e0bbc226feffcf63e1b0cb2","observation_id":"5f69df78-e37e-4e62-9220-a170b5526b5a","resolution":{"observed_at":"2026-08-15T22:35:59.427202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.874905Z","title":"Reddit - Dive into anything,","venue":null,"work_id":"9bc192e6-699d-4ed1-b95c-db911b3373e1","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.431391Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:95a116e9b2b8841db3262d12817eea85ae9d7a1ddcfae43951f41eb25474a23d","observation_id":"312e27f6-385f-4ec9-99b2-40ba1dc42cff","resolution":{"observed_at":"2026-08-15T22:35:59.878749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.862594Z","title":"lakshaychhabra/NSFW-Detection-DL,","venue":null,"work_id":"3926f671-92f3-4a6d-9085-297c05df67fe","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.435249Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:d1fb196e910deeb47a6de1e03802b103c425e990937aebfcc3fa7f48747de67c","observation_id":"61f94c81-ad6c-4a21-aff0-735097efda1f","resolution":{"observed_at":"2026-08-15T22:35:59.866834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.849567Z","title":"LAION-AI/CLIP-based-NSFW-Detector,","venue":null,"work_id":"f5edf39c-8ec8-4ea1-9e09-30c6b83b5c0f","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.438837Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:09650f5a8f57dee5b014c3659887513c0250eab3f49d494cf88a60501f47de99","observation_id":"d5e14667-47da-41e6-a73d-5349af3cd293","resolution":{"observed_at":"2026-08-15T22:35:59.853770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.837058Z","title":"alex000kim/nsfw data scraper: Collection of scripts to aggregate image data for the purposes of training an NSFW Image Classifier","venue":null,"work_id":"f0c7d8ad-f639-4d46-99d5-248f6557835d","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.442250Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:28c91984f48ecc5aeda5e78f3110970d8905cea9c8d01d31be5b0e96a43f7a87","observation_id":"f6bf726e-827e-4f25-b222-ccd97b48b67a","resolution":{"observed_at":"2026-08-15T22:35:59.841509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.445899Z","title":"Generating natural language adversarial examples through probability weighted word saliency,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.445899Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:0c194448ecf8eb9d8decc53d52859050eb9724beba791a238955258822bdf7ae","observation_id":"884cb5a2-60a0-489f-b746-6c669a67051b","resolution":{"observed_at":"2026-08-15T22:35:59.445899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.817287Z","title":"Is bert really robust? a strong baseline for natural language attack on text classification and entailment,","venue":null,"work_id":"2769fe4b-1528-4d7b-96b5-a20c71d7c000","year":2020},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.449489Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:f73e2c2f8d97279ea087638a140763ddc19525712013f509e0f0561ceb2a124d","observation_id":"b9bee413-41f9-4007-9ea0-749e6826dc76","resolution":{"observed_at":"2026-08-15T22:35:59.821619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.805664Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"63de2e52-4046-4c58-8452-d697da416465","year":2021},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.453197Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:b16876b862f336ecefbdf36ce3a0dd78b752b0fc1ca88b411615e3cdf562d62c","observation_id":"16560f73-f7fa-4af0-99a0-57eb54738770","resolution":{"observed_at":"2026-08-15T22:35:59.809477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.793595Z","title":"first20hours/google-10000-english,","venue":null,"work_id":"9f1795fa-66b0-4043-b498-7b5288ea8f7d","year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.457059Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:62203cc6700c52d2f9146f9b7ccc698632e91836a32e0561c0192703f2d5c63b","observation_id":"4629eef3-7cd6-41b3-8e33-15b0f5f98633","resolution":{"observed_at":"2026-08-15T22:35:59.797326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11313","last_updated":"2025-04-02T08:03:11Z","snapshot_observed_at":"2026-08-16T13:25:01.414450Z","submitted_at":"2024-08-21T03:35:24Z","title":"An Optimizable Suffix Is Worth A Thousand Templates: Efficient Black-box Jailbreaking without Affirmative Phrases via LLM as Optimizer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11313","snapshot_observed_at":"2026-08-15T22:35:59.460659Z","title":"Unlocking ad- versarial suffix optimization without affirmative phrases: Efficient black- box jailbreaking via llm as optimizer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.460659Z"},"links":{"cited_paper":"/paper/2408.11313","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:7f9fdce13a84a37ce1e88638b48d31f5ab1e7a6b93d6a18d86d0b718b5333e5d","observation_id":"10569917-1464-46c5-a4ef-90a43b49dad7","resolution":{"observed_at":"2026-08-15T22:35:59.460659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.781728Z","title":"TokenProber","venue":null,"work_id":"c9bbdf1f-1eaf-4288-890b-2f4bf2d4f23b","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.464603Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:70a847c29437db784c57fe491c5b1f291950146bf5279f69cc871e2e59f1c488","observation_id":"8c71b0c3-9aad-41be-9191-ce895357309d","resolution":{"observed_at":"2026-08-15T22:35:59.785779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.02793","last_updated":"2016-02-29T17:56:29Z","snapshot_observed_at":"2026-08-14T22:24:12.703068Z","submitted_at":"2015-11-09T18:18:53Z","title":"Generating Images from Captions with Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.02793","snapshot_observed_at":"2026-08-15T22:35:59.467909Z","title":"Generating images from captions with attention,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.467909Z"},"links":{"cited_paper":"/paper/1511.02793","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:dde11bcf7f5c86aac842803b0733b8b80013abeabb931fd1181e2e13a238a74b","observation_id":"0cb69a7b-4972-4f25-ba17-2d8974e1e7ae","resolution":{"observed_at":"2026-08-15T22:35:59.467909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.768841Z","title":"Attngan: Fine-grained text to image generation with attentional generative adversarial networks,","venue":null,"work_id":"b00c9252-0d27-48c4-9654-f13886a12274","year":2018},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.471534Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:01f074a942e55c3afdc388e15e627eaac7116018caed8d200c383dabd56b837a","observation_id":"df054324-5201-48be-9d80-6347f12cd17f","resolution":{"observed_at":"2026-08-15T22:35:59.773230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.756402Z","title":"Text-to-image gener- ation grounded by fine-grained user attention,","venue":null,"work_id":"8e2f716f-46a1-4f30-8920-a1387cb8aeb4","year":2021},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.474969Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:7c0a0c2e84db661e6197f9b5474f292526ed41c8f7877e63a3e8fe643f107502","observation_id":"f256a51b-73d4-4e2e-aa63-b7d4b4aaffdc","resolution":{"observed_at":"2026-08-15T22:35:59.760295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.744676Z","title":"Plug & play generative networks: Conditional iterative generation of images in latent space,","venue":null,"work_id":"08f38612-e7e1-4fe4-b363-e2f44e09ec1e","year":2017},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.478426Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:ca1854a88af1e7e89c862f787c4ffde47d2593d09c0749addb083efd2473aeb7","observation_id":"66748de7-7ab2-434d-8487-7b1d4c6b60f8","resolution":{"observed_at":"2026-08-15T22:35:59.748498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.481842Z","title":"Generative adversarial networks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.481842Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:10554ca28ee2a020517c7ae7b3251ca8fd5fa4cf34e5b47bb712bd9fe443c19e","observation_id":"f238f151-b493-4d85-972e-beb019a98ee9","resolution":{"observed_at":"2026-08-15T22:35:59.481842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-08-16T19:10:09.657437Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-15T22:35:59.485291Z","title":"Conditional generative adversarial nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.485291Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:8601087fc0959dadb278c6f3b0867a3a581104a9d06059409bb71cdac4531aad","observation_id":"4ca2b4ea-a9a8-4de0-9f9d-d2d3d38afea7","resolution":{"observed_at":"2026-08-15T22:35:59.485291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.489049Z","title":"Stackgan: Text to photo-realistic image synthesis with stacked generative adversarial networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.489049Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:95d43273fee05b67308f67034aca7039320f0a0a8bd7e7456bdc8dd5487bf1cd","observation_id":"c4d48dea-d47b-4ead-b721-3a4f068231ee","resolution":{"observed_at":"2026-08-15T22:35:59.489049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.492594Z","title":"Controllable text-to-image generation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.492594Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:d0364f3057db6804ddaf6296a5de19ea7cd4f51679d38a3093e17c3a59c1764a","observation_id":"eaf4ada7-4966-4667-8503-41e9dc7c2dba","resolution":{"observed_at":"2026-08-15T22:35:59.492594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.496343Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.496343Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:9279a44a52ba8be19ac43656a413166f261fa36ec4c890f2c8a1e232628afc0c","observation_id":"1b4c0af1-76fe-4a74-ba6b-6c7feefc9d94","resolution":{"observed_at":"2026-08-15T22:35:59.496343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.703580Z","title":"Vector quantized diffusion model for text-to-image synthesis,","venue":null,"work_id":"7669ed03-5fdc-42a2-9c57-e46886f8d9c3","year":2022},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.499765Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:cfd2c1129f50d55754c6246620c620025a8bc3f9e99481552db30c9d4c136fc9","observation_id":"cfdaa996-5f7d-4357-9207-28edb3670a06","resolution":{"observed_at":"2026-08-15T22:35:59.708264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-15T22:35:59.503310Z","title":"Glide: Towards photorealistic image gen- eration and editing with text-guided diffusion models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.503310Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:9d588ea25a9ac82671aa32467b87a1196cb13441c5b69d5fb6716204b2b480cb","observation_id":"9689b6c4-0e08-4a33-ae86-5aecf4a19356","resolution":{"observed_at":"2026-08-15T22:35:59.503310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:35:59.912391Z","title":"Available: www.reddit.com/r/ChatGPT/comments/ 11vlp7j/nsfwgpt that nsfw prompt/","venue":null,"work_id":"1260a526-464d-4d4f-bc19-cfb9530791cd","year":null},"citing_paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T22:35:59.416315Z"},"links":{"citing_paper":"/paper/2505.08804"},"observation_digest":"sha256:fb481707fd0d8c1c1390ec5ffc374502372b28e8317824c35e9ec62de5754309","observation_id":"ae88bf7e-ad55-41ab-b0b4-1dfde0582d00","resolution":{"observed_at":"2026-08-15T22:35:59.916547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.08804","last_updated":"2025-05-11T06:32:33Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-15T22:28:37.495619Z","submitted_at":"2025-05-11T06:32:33Z","title":"TokenProber: Jailbreaking Text-to-image Models via Fine-grained Word Impact Analysis"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2505.08804."}