{"as_of":"2026-08-07T09:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ff2395231a2f2d6f3fd4bbbe854348920eafabb10175eb42c4a50f513cce4d9b","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:11:18.419497Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:32:12.095863Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:58:58.591719Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00841","snapshot_observed_at":"2026-08-05T22:32:12.095863Z","title":"Safemobile: Chain-level jailbreak detection and automated evaluation for multimodal mobile agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06841","last_updated":"2025-08-09T05:48:30Z","snapshot_observed_at":"2026-08-07T07:34:45.871968Z","submitted_at":"2025-08-09T05:48:30Z","title":"Memory Enhanced Fractional-Order Dung Beetle Optimization for Photovoltaic Parameter Identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:32:12.095863Z"},"links":{"cited_paper":"/paper/2507.00841","citing_paper":"/paper/2508.06841"},"observation_digest":"sha256:f9f9806a1b81393edc7475a0dcc122830d908c7198252b302f83cc3133f896cf","observation_id":"611200dc-a5da-442e-99ec-c4025377d53e","resolution":{"observed_at":"2026-08-05T22:32:12.095863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"cited_work":{"arxiv_id":"2507.00841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00841","snapshot_observed_at":"2026-07-03T20:58:58.591719Z","title":"arXiv preprint arXiv:2507.00841 , year=","venue":null,"work_id":"8eabd457-30b8-4c8e-a726-6a58e37a37d8","year":2025},"citing_paper":{"arxiv_id":"2605.10386","last_updated":"2026-05-11T11:28:03Z","snapshot_observed_at":"2026-07-30T05:21:48.152751Z","submitted_at":"2026-05-11T11:28:03Z","title":"GuardAD: Safeguarding Autonomous Driving MLLMs via Markovian Safety Logic","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-12T05:17:42.003708Z"},"links":{"cited_paper":"/paper/2507.00841","citing_paper":"/paper/2605.10386"},"observation_digest":"sha256:ca18ae405c065985be127d488767be0e97874bcb7d341dbb3ec0bcc743eb243a","observation_id":"23c60d0b-e663-4b30-85cf-4e4b48bddf43","resolution":{"observed_at":"2026-05-12T05:21:27.515467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"cited_work":{"arxiv_id":"2507.00841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00841","snapshot_observed_at":"2026-07-03T20:58:58.591719Z","title":"arXiv preprint arXiv:2507.00841 , year=","venue":null,"work_id":"8eabd457-30b8-4c8e-a726-6a58e37a37d8","year":2025},"citing_paper":{"arxiv_id":"2606.18008","last_updated":"2026-06-16T14:53:30Z","snapshot_observed_at":"2026-08-07T06:46:48.120223Z","submitted_at":"2026-06-16T14:53:30Z","title":"PhaseWin: An Efficient Search Algorithm for Faithful Visual Attribution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T00:57:24.855665Z"},"links":{"cited_paper":"/paper/2507.00841","citing_paper":"/paper/2606.18008"},"observation_digest":"sha256:25d22f1821c0edcaf7e7f626442ba5482150e757b863e53892bc2db7fb8d6831","observation_id":"4af0f3b1-729e-4ac4-9570-ca4251400d23","resolution":{"observed_at":"2026-07-03T20:58:58.593211Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"cited_work":{"arxiv_id":"2507.00841","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.00841","snapshot_observed_at":"2026-07-03T20:58:58.591719Z","title":"arXiv preprint arXiv:2507.00841 , year=","venue":null,"work_id":"8eabd457-30b8-4c8e-a726-6a58e37a37d8","year":2025},"citing_paper":{"arxiv_id":"2606.27944","last_updated":"2026-06-26T10:37:32Z","snapshot_observed_at":"2026-08-03T10:11:06.084788Z","submitted_at":"2026-06-26T10:37:32Z","title":"It Lied to a Doctor to Buy Poison Ingredients: Quantifying Real-World Misuse of Phone-use Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T02:04:51.936838Z"},"links":{"cited_paper":"/paper/2507.00841","citing_paper":"/paper/2606.27944"},"observation_digest":"sha256:93feb47ba0c5751e8dd728fc92cc3bd0e1710a52b136f46d37250f0769d90616","observation_id":"f74f5399-fa55-4c79-84b4-80fac88627d6","resolution":{"observed_at":"2026-07-01T18:25:57.684093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.00841/citation-record","integrity":"/paper/2507.00841/integrity","json":"/paper/2507.00841/citation-record.json","paper":"/paper/2507.00841"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.539472Z","title":"Multimodal foundation models: From specialists to general-purpose assistants,","venue":null,"work_id":"7ce5fbc2-bd96-490c-8611-5e71a5334e6c","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.159067Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:d99af2fc74d3666a45616a750229ba3a64923cf0e5992abe53dfe61d38be0b3f","observation_id":"d854ac20-d800-40e9-a9e8-81faae9421b0","resolution":{"observed_at":"2026-08-06T21:11:19.545023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.523555Z","title":"Towards artificial general intelligence via a multimodal foundation model,","venue":null,"work_id":"98c1c387-844e-44b1-b2d4-590129ec4ec1","year":2022},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.164656Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:6079064b07c3512c151387ecbb706e3c10a5225b93658e58b07ff22c4c39dd40","observation_id":"b9371e58-7bbd-4167-bce8-4a6dcc2f79aa","resolution":{"observed_at":"2026-08-06T21:11:19.528598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03418","last_updated":"2024-07-03T18:00:48Z","snapshot_observed_at":"2026-08-03T01:16:48.562339Z","submitted_at":"2024-07-03T18:00:48Z","title":"HEMM: Holistic Evaluation of Multimodal Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03418","snapshot_observed_at":"2026-08-06T21:11:18.169318Z","title":"Hemm: Holistic evaluation of multimodal foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.169318Z"},"links":{"cited_paper":"/paper/2407.03418","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:46c9a85a443ed9d54888a69b396281b80f1ece29edbca90ebb4b1aeeeb8a3d0d","observation_id":"79381858-a62e-42ed-90c1-cb7cbae83105","resolution":{"observed_at":"2026-08-06T21:11:18.169318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04180","last_updated":"2025-06-09T05:15:47Z","snapshot_observed_at":"2026-08-07T06:45:33.678975Z","submitted_at":"2025-02-06T16:12:06Z","title":"Multi-agent Architecture Search via Agentic Supernet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04180","snapshot_observed_at":"2026-08-06T21:11:18.175027Z","title":"Multi-agent architecture search via agentic supernet,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.175027Z"},"links":{"cited_paper":"/paper/2502.04180","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:7aa62f8ed1d9fbdcd15e0ef30d6a404e8a7dfb31d51f36828d58d6b44c66b125","observation_id":"a05c567c-8b0c-417a-98aa-4e40f4cfc637","resolution":{"observed_at":"2026-08-06T21:11:18.175027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02506","last_updated":"2024-10-03T14:14:31Z","snapshot_observed_at":"2026-08-06T07:05:30.821556Z","submitted_at":"2024-10-03T14:14:31Z","title":"Cut the Crap: An Economical Communication Pipeline for LLM-based Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02506","snapshot_observed_at":"2026-08-06T21:11:18.179806Z","title":"Cut the crap: An economical communication pipeline for llm-based multi-agent systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.179806Z"},"links":{"cited_paper":"/paper/2410.02506","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:854348ab7dcfc94a0d388461431b3c320bbe9b7324d4ab705e9434b905c864d2","observation_id":"c0687ca9-ff5d-4b49-8100-432751a1effa","resolution":{"observed_at":"2026-08-06T21:11:18.179806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11782","last_updated":"2025-02-06T15:37:52Z","snapshot_observed_at":"2026-08-04T04:02:29.838505Z","submitted_at":"2024-10-15T17:01:21Z","title":"G-Designer: Architecting Multi-agent Communication Topologies via Graph Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11782","snapshot_observed_at":"2026-08-06T21:11:18.184856Z","title":"G-designer: Architecting multi-agent communication topologies via graph neural networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.184856Z"},"links":{"cited_paper":"/paper/2410.11782","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:524e641a5d5be540483d8167aa80ccae947379a55227ae995d0cfc07db6a540a","observation_id":"023d88d1-aa09-41cb-962b-7611c3a18a2c","resolution":{"observed_at":"2026-08-06T21:11:18.184856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-07-06T21:12:51.325430Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15585","snapshot_observed_at":"2026-08-06T21:11:18.191017Z","title":"A comprehensive survey in llm (- agent) full stack safety: Data, training and deployment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.191017Z"},"links":{"cited_paper":"/paper/2504.15585","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:67f6e8a70a50eb81bc5c5c72a0d46092fb3f0107fe07447267c103da376fca4c","observation_id":"b438ebc6-52ae-409a-a544-a4776270ec1a","resolution":{"observed_at":"2026-08-06T21:11:18.191017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01014","last_updated":"2024-06-03T05:50:00Z","snapshot_observed_at":"2026-08-06T22:15:02.337988Z","submitted_at":"2024-06-03T05:50:00Z","title":"Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01014","snapshot_observed_at":"2026-08-06T21:11:18.196423Z","title":"Mobile-agent-v2: Mobile device operation assistant with effective navigation via multi-agent collaboration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.196423Z"},"links":{"cited_paper":"/paper/2406.01014","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:02c233e03ec2bebfadb640b45c969b70103c6505de9d8b15b84bfc5e7a8b653c","observation_id":"c168babd-f642-4501-9835-b8e7e38567d4","resolution":{"observed_at":"2026-08-06T21:11:18.196423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.505839Z","title":"Mobilegpt: Augmenting llm with human-like app memory for mobile task automation,","venue":null,"work_id":"26a5dbd3-43f2-4b5c-999e-2fbf5bea9065","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.201890Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:aec1718373f89b7af4c3846eb7155f19c35cd27e0339fe8715d9c425d0bfd8b7","observation_id":"0c701e6c-f11a-4409-abbd-6a26340c3380","resolution":{"observed_at":"2026-08-06T21:11:19.511334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03913","last_updated":"2024-07-04T13:12:19Z","snapshot_observed_at":"2026-07-06T18:41:31.849952Z","submitted_at":"2024-07-04T13:12:19Z","title":"MobileExperts: A Dynamic Tool-Enabled Agent Team in Mobile Devices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03913","snapshot_observed_at":"2026-08-06T21:11:18.207157Z","title":"Mobileexperts: A dynamic tool-enabled agent team in mobile devices,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.207157Z"},"links":{"cited_paper":"/paper/2407.03913","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:bdf8a573c99415c7b7d2c4383dc55be4da10d2d83f159fe17ceab8c74b6d55d3","observation_id":"5cc6c708-016c-4949-8c38-c14ae10b85ed","resolution":{"observed_at":"2026-08-06T21:11:18.207157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.212372Z","title":"A survey on evaluation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.212372Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:a11a819daf52b17e04bab6a4ee84ab82fedaf1f1f59ec050d30af164c7b27152","observation_id":"406bf775-53f4-4151-8833-e7c7a35018d9","resolution":{"observed_at":"2026-08-06T21:11:18.212372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-06T21:11:18.217493Z","title":"A comprehensive overview of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.217493Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:0207a974f4702d7007c0b57d3e76c9f43758d6cd3680b7fcda111e1091895c84","observation_id":"fe56039b-5193-4512-87b2-1a86cf2d14bb","resolution":{"observed_at":"2026-08-06T21:11:18.217493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04031","last_updated":"2024-07-01T14:25:23Z","snapshot_observed_at":"2026-08-05T18:40:45.767406Z","submitted_at":"2024-06-06T13:00:42Z","title":"Jailbreak Vision Language Models via Bi-Modal Adversarial Prompt","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04031","snapshot_observed_at":"2026-08-06T21:11:18.221976Z","title":"Jailbreak vision language models via bi-modal adversarial prompt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.221976Z"},"links":{"cited_paper":"/paper/2406.04031","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:8faa9e72cb904c0d10543f1ff0b572d55860927be19c51a1f7aedd41202436da","observation_id":"667e004a-1aaf-4620-82b6-ff1b3d6d6ffe","resolution":{"observed_at":"2026-08-06T21:11:18.221976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14872","last_updated":"2024-02-27T13:49:22Z","snapshot_observed_at":"2026-08-06T14:36:18.172649Z","submitted_at":"2024-02-21T15:13:50Z","title":"Semantic Mirror Jailbreak: Genetic Algorithm Based Jailbreak Prompts Against Open-source LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14872","snapshot_observed_at":"2026-08-06T21:11:18.227024Z","title":"Semantic mirror jailbreak: Genetic algorithm based jailbreak prompts against open-source llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.227024Z"},"links":{"cited_paper":"/paper/2402.14872","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:08561ff042de35c6dd46b22c1e849e23571d2e85dbdaf6994c5711e95b7616be","observation_id":"e1e25b99-e242-43f9-bde2-b85856d93b34","resolution":{"observed_at":"2026-08-06T21:11:18.227024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11815","last_updated":"2025-01-22T03:17:01Z","snapshot_observed_at":"2026-07-06T20:23:36.052687Z","submitted_at":"2025-01-21T01:45:56Z","title":"CogMorph: Cognitive Morphing Attacks for Text-to-Image Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11815","snapshot_observed_at":"2026-08-06T21:11:18.231476Z","title":"Cogmorph: Cognitive morphing attacks for text-to-image models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.231476Z"},"links":{"cited_paper":"/paper/2501.11815","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:184827d01d58391b119a3971071e0fb192f0d0d10e493ffd24cfa295004d63e4","observation_id":"af2ac908-4dea-4d09-bbf9-0da22722e0bc","resolution":{"observed_at":"2026-08-06T21:11:18.231476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08813","last_updated":"2025-04-09T06:53:23Z","snapshot_observed_at":"2026-07-06T21:08:05.749656Z","submitted_at":"2025-04-09T06:53:23Z","title":"SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.08813","snapshot_observed_at":"2026-08-06T21:11:18.236611Z","title":"Safemlrm: Demystifying safety in multi-modal large reasoning models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.236611Z"},"links":{"cited_paper":"/paper/2504.08813","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:78431e4ba8b6e2c52a8a98d02495df8fcbb693a9bf4bc2e720a77fb4115de337","observation_id":"bbd4317b-861f-4e89-a59c-5a7e837295f4","resolution":{"observed_at":"2026-08-06T21:11:18.236611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02355","last_updated":"2025-04-22T16:15:47Z","snapshot_observed_at":"2026-08-07T08:26:37.732830Z","submitted_at":"2024-10-03T10:06:27Z","title":"AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02355","snapshot_observed_at":"2026-08-06T21:11:18.241641Z","title":"Alphaedit: Null-space constrained knowledge editing for language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.241641Z"},"links":{"cited_paper":"/paper/2410.02355","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:c20f9777bc69b0146bb963058155587a8e5a39102ac84bd11df96e58ec79e216","observation_id":"c1c3a9ee-8bc7-42cb-b0c3-2da3b1a909c2","resolution":{"observed_at":"2026-08-06T21:11:18.241641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13708","last_updated":"2025-02-24T13:31:08Z","snapshot_observed_at":"2026-07-06T19:35:26.421419Z","submitted_at":"2024-10-17T16:08:06Z","title":"On the Role of Attention Heads in Large Language Model Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13708","snapshot_observed_at":"2026-08-06T21:11:18.246898Z","title":"On the role of attention heads in large language model safety,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.246898Z"},"links":{"cited_paper":"/paper/2410.13708","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:098c8c115c3928a902e635a1845b405c071d6ddb9681a6ee863fa1760a728cc3","observation_id":"3ab5dd33-7b72-478c-8828-a72b8a526888","resolution":{"observed_at":"2026-08-06T21:11:18.246898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17704","last_updated":"2025-05-24T12:50:56Z","snapshot_observed_at":"2026-08-05T02:35:48.729793Z","submitted_at":"2025-04-24T16:11:01Z","title":"Safety in Large Reasoning Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17704","snapshot_observed_at":"2026-08-06T21:11:18.251385Z","title":"Safety in large reasoning models: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.251385Z"},"links":{"cited_paper":"/paper/2504.17704","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:571e894e46d7964d3c1c6251d48f684296042951fee2e46aa8cb77cf9e99f85c","observation_id":"4ec67418-7368-4711-ae4c-87b048c4808a","resolution":{"observed_at":"2026-08-06T21:11:18.251385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11127","last_updated":"2025-02-16T13:48:41Z","snapshot_observed_at":"2026-08-01T18:39:47.677655Z","submitted_at":"2025-02-16T13:48:41Z","title":"G-Safeguard: A Topology-Guided Security Lens and Treatment on LLM-based Multi-agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11127","snapshot_observed_at":"2026-08-06T21:11:18.256492Z","title":"G-safeguard: A topology-guided security lens and treatment on llm-based multi-agent systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.256492Z"},"links":{"cited_paper":"/paper/2502.11127","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:0e360f815e8e06656ddf7a8314cb595b8d75e376902d8504d1826b167c3a6945","observation_id":"dbe74690-1c5c-4bc5-a40f-4d563f20d2b0","resolution":{"observed_at":"2026-08-06T21:11:18.256492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09648","last_updated":"2025-03-12T08:42:05Z","snapshot_observed_at":"2026-07-06T20:51:32.396503Z","submitted_at":"2025-03-12T08:42:05Z","title":"A Survey on Trustworthy LLM Agents: Threats and Countermeasures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09648","snapshot_observed_at":"2026-08-06T21:11:18.260987Z","title":"A survey on trustworthy llm agents: Threats and countermeasures,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.260987Z"},"links":{"cited_paper":"/paper/2503.09648","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:13af1c1bacb1cd3aeb1935a5a9e5b2fac4ae59db3d5c8eb0771b031ae6b15447","observation_id":"c0ef321c-e090-4cdd-9fc2-cb1b5c5587c2","resolution":{"observed_at":"2026-08-06T21:11:18.260987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.474524Z","title":"Badclip: Dual-embedding guided backdoor attack on multimodal contrastive learning,","venue":null,"work_id":"3c706f12-5fbb-4049-99dc-c7106dfa03e9","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.265371Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:3d79ddf24f782bda75c719498d897a7bf872771ede9e9382ce422cb044502480","observation_id":"da2ef240-28d7-4ba6-8ef3-ca316fe88bb3","resolution":{"observed_at":"2026-08-06T21:11:19.479685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11054","last_updated":"2025-03-11T03:06:17Z","snapshot_observed_at":"2026-07-06T20:37:18.647879Z","submitted_at":"2025-02-16T09:27:44Z","title":"Reasoning-Augmented Conversation for Multi-Turn Jailbreak Attacks on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11054","snapshot_observed_at":"2026-08-06T21:11:18.269535Z","title":"Reasoning-augmented conversation for multi-turn jailbreak attacks on large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.269535Z"},"links":{"cited_paper":"/paper/2502.11054","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:f796dbe721d817c04a095eaefb1ddeb2fe2dbf775769c1f9e31011d1cbe309f7","observation_id":"99a98ead-e50d-4f63-97b6-bd16d713a229","resolution":{"observed_at":"2026-08-06T21:11:18.269535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.455756Z","title":"Vl-trojan: Multimodal instruc- tion backdoor attacks against autoregressive visual language models,","venue":null,"work_id":"5ad30317-e394-42ee-87e4-81686094a8c1","year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.273892Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:7fd28c1ecede1a8847245e503aed906ac1c7352fed5c3d3a1705d98bd2b6e607","observation_id":"e411e200-a6e7-4bc5-b66c-ba2943ee8641","resolution":{"observed_at":"2026-08-06T21:11:19.461652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12981","last_updated":"2025-05-20T07:02:05Z","snapshot_observed_at":"2026-07-06T21:26:11.353127Z","submitted_at":"2025-05-19T11:17:46Z","title":"From Assistants to Adversaries: Exploring the Security Risks of Mobile LLM Agents","version":2},"cited_work":{"arxiv_id":"2505.12981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.12981","snapshot_observed_at":"2026-08-06T21:11:18.938391Z","title":"From Assistants to Adversaries: Exploring the Security Risks of Mobile LLM Agents","venue":"cs.CR","work_id":"22e71f17-baa9-4d22-81ba-c5521cd6f022","year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.279076Z"},"links":{"cited_paper":"/paper/2505.12981","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:2f2bf8fcccb164ae46ed6377281d7781ff58a4953589e581ac07b36d0b7d6b20","observation_id":"17cc5d21-b88f-4424-a663-36f7f9b2cd75","resolution":{"observed_at":"2026-08-06T21:11:18.944034Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.438803Z","title":"Rico: A mobile app dataset for building data-driven design applications,","venue":null,"work_id":"845defa7-3c1b-49ca-92cf-686be1c09e91","year":2017},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.284238Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:8901753e97833f6462c6ede1fd6d2830a6838601fac250c600fea46889d8803b","observation_id":"0a12891e-6e68-4909-a568-a90b939a7856","resolution":{"observed_at":"2026-08-06T21:11:19.444149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.289049Z","title":"Theoretical analysis of kl-regularized rlhf with multiple reference models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.289049Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:c174f9e68a074a6c40099fe878ec9d8b7185ea04e65f93bad540e2b5019ea051","observation_id":"9b08102a-965f-451c-96c4-41e631ce0041","resolution":{"observed_at":"2026-08-06T21:11:18.289049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00267","last_updated":"2024-09-03T14:01:54Z","snapshot_observed_at":"2026-07-06T16:13:07.384791Z","submitted_at":"2023-09-01T05:53:33Z","title":"RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00267","snapshot_observed_at":"2026-08-06T21:11:18.293844Z","title":"Rlaif vs. rlhf: Scaling reinforce- ment learning from human feedback with ai feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.293844Z"},"links":{"cited_paper":"/paper/2309.00267","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:d8f3d304f6c97edb26199a529930925db4a872f0f11bedb165ac30c6cf165326","observation_id":"dd3f55c4-0321-4163-ac4a-258f0b3445aa","resolution":{"observed_at":"2026-08-06T21:11:18.293844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04626","last_updated":"2024-04-06T13:24:37Z","snapshot_observed_at":"2026-07-06T17:56:32.062035Z","submitted_at":"2024-04-06T13:24:37Z","title":"Towards Analyzing and Understanding the Limitations of DPO: A Theoretical Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04626","snapshot_observed_at":"2026-08-06T21:11:18.299379Z","title":"Towards analyzing and understanding the limitations of dpo: A theoretical perspective,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.299379Z"},"links":{"cited_paper":"/paper/2404.04626","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:0941a497a48fa116d5b69713618fd9e48e95183f04d939f60ff43f8d712b6e16","observation_id":"11213979-cfc9-444d-a231-6100890f1019","resolution":{"observed_at":"2026-08-06T21:11:18.299379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10719","last_updated":"2024-10-10T08:30:17Z","snapshot_observed_at":"2026-07-06T18:01:05.698046Z","submitted_at":"2024-04-16T16:51:53Z","title":"Is DPO Superior to PPO for LLM Alignment? A Comprehensive Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10719","snapshot_observed_at":"2026-08-06T21:11:18.304909Z","title":"Is dpo superior to ppo for llm alignment? a comprehensive study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.304909Z"},"links":{"cited_paper":"/paper/2404.10719","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:8406b06184873735196cc0d35e2f0d055ac3c3aced981a55a53871e7e804a598","observation_id":"c3ca2522-a8b8-4d8d-a2ef-881fc3393e21","resolution":{"observed_at":"2026-08-06T21:11:18.304909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T21:11:18.309572Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.309572Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:50ae07c414a68efae65c801dd2cf447541bf296b0e9942e4a19add273dea4f51","observation_id":"eb2b51fe-df35-4eb6-9cc2-452c0dc66de3","resolution":{"observed_at":"2026-08-06T21:11:18.309572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T21:11:18.313818Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.313818Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:f822e71d0b6d3e1db1f14880b537edefd93daec2f4e7806fc8faded078c434ec","observation_id":"5cc4cec0-cf9e-40ee-94ab-48ec1a5a7663","resolution":{"observed_at":"2026-08-06T21:11:18.313818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.421377Z","title":"Mis- tral: Dynamically managing power, performance, and adaptation cost in cloud infrastructures,","venue":null,"work_id":"69316c9c-66c4-4ae2-8f7e-4e2c0cd34012","year":2010},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.318202Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:745c8083bee9d78b3faa41d446b395aa772a7dfee015ed3014399e8dc54c5b5a","observation_id":"26801bb9-22f3-407b-beb8-cd8f0ba2e3dd","resolution":{"observed_at":"2026-08-06T21:11:19.426899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T21:11:18.322708Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.322708Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:6918d65ffd3a527a2971367b12455b80e16b9288505a55a464856f52361698e2","observation_id":"e3f0a748-edfc-40a0-b0fe-51019989b903","resolution":{"observed_at":"2026-08-06T21:11:18.322708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T21:11:18.327905Z","title":"Gemma: Open models based on gemini research and technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.327905Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:832cbb0bc9a2d6be89aad08ddcc18f7af454b674d33facb371cb29a7843ce25f","observation_id":"7ef7b3c3-c895-48ea-9f19-26bfdb36e38a","resolution":{"observed_at":"2026-08-06T21:11:18.327905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.401984Z","title":null,"venue":null,"work_id":"15bd10a4-dd74-487b-b985-8d4c0ba6f722","year":1980},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.333330Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:b883cabeedb084ee16529cbe0b1ab7d7b4dbb2804581c4be8cf73a19ea205de4","observation_id":"5cc399d5-41ee-49e4-ae77-583c1eef39d3","resolution":{"observed_at":"2026-08-06T21:11:19.408432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T21:11:18.337724Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.337724Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:ce553312ebec9945c4c2c4b1777dc6dfda8b35cb58afec52468a71796b256054","observation_id":"0d2b9b01-3afe-4da7-9ddb-f610378a99c1","resolution":{"observed_at":"2026-08-06T21:11:18.337724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T21:11:18.342213Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.342213Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:a4c0bcf7805bc4f902553c35477d6edc8d1cc5a7ecc7e05d60e3917e30ed447b","observation_id":"579c4326-c330-4b13-9ace-81ca145f159c","resolution":{"observed_at":"2026-08-06T21:11:18.342213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.347233Z","title":"Appagent: Multimodal agents as smartphone users,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.347233Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:a50c852567ad430d0fc9f3de176547b9c922e7c48fa1308f37b3e772f9ad0860","observation_id":"6cba9069-851e-4876-93eb-de688730f647","resolution":{"observed_at":"2026-08-06T21:11:18.347233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.374505Z","title":"Autodroid: Llm-powered task automation in android,","venue":null,"work_id":"c2da5ded-0b0b-4c0b-9ca4-7a56fa02472f","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.351614Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:68871fbb8f4136c9bbf875cd78b64ae00dd6066a1b8dd908a28a14ae7c9454b1","observation_id":"26534201-1a96-433b-92bc-483bad5702ae","resolution":{"observed_at":"2026-08-06T21:11:19.380077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07061","last_updated":"2024-01-07T08:23:47Z","snapshot_observed_at":"2026-07-06T15:15:42.652360Z","submitted_at":"2023-04-14T11:31:56Z","title":"DroidBot-GPT: GPT-powered UI Automation for Android","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07061","snapshot_observed_at":"2026-08-06T21:11:18.356480Z","title":"Droidbot-gpt: Gpt-powered ui automation for android,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.356480Z"},"links":{"cited_paper":"/paper/2304.07061","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:a5c16087844a66846fe211fc6ea58923748e09c65324ce27e2900d7fd676d2e2","observation_id":"936a4b81-adda-44eb-b640-f8070c2413cb","resolution":{"observed_at":"2026-08-06T21:11:18.356480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11941","last_updated":"2024-06-02T13:25:05Z","snapshot_observed_at":"2026-08-06T20:03:08.814025Z","submitted_at":"2024-02-19T08:29:03Z","title":"CoCo-Agent: A Comprehensive Cognitive MLLM Agent for Smartphone GUI Automation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11941","snapshot_observed_at":"2026-08-06T21:11:18.361907Z","title":"Coco-agent: A comprehensive cog- nitive mllm agent for smartphone gui automation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.361907Z"},"links":{"cited_paper":"/paper/2402.11941","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:ce0094867f86ad4a3ba6709a2cf06996388f2b5e791346ae18f300a5b66b5de7","observation_id":"48d8b35c-0eb5-48b9-90ac-7d9ddacfdd76","resolution":{"observed_at":"2026-08-06T21:11:18.361907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13805","last_updated":"2025-04-18T17:13:34Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:13:34Z","title":"LearnAct: Few-Shot Mobile GUI Agent with a Unified Demonstration Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13805","snapshot_observed_at":"2026-08-06T21:11:18.366808Z","title":"Learnact: Few-shot mobile gui agent with a unified demonstration benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.366808Z"},"links":{"cited_paper":"/paper/2504.13805","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:dfeec4c0ec0aeb8358407c79940ddab2d196caf4b664b89a83a65a586cd56599","observation_id":"7d4616db-bd25-4416-9d4e-8a7fec0c8bd7","resolution":{"observed_at":"2026-08-06T21:11:18.366808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02982","last_updated":"2025-05-20T07:03:02Z","snapshot_observed_at":"2026-08-04T06:38:17.059368Z","submitted_at":"2025-02-05T08:26:17Z","title":"MobileA3gent: Training Mobile GUI Agents Using Decentralized Self-Sourced Data from Diverse Users","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02982","snapshot_observed_at":"2026-08-06T21:11:18.371502Z","title":"Fedmo- bileagent: Training mobile agents using decentralized self-sourced data from diverse users,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.371502Z"},"links":{"cited_paper":"/paper/2502.02982","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:d8d60340c4ad9e0b89ccaa6a78644b87b8bac00208d17d45f4fa912f60888395","observation_id":"34bcb531-44d5-44b4-b1fa-97e2047b5026","resolution":{"observed_at":"2026-08-06T21:11:18.371502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.376080Z","title":"Advancing mobile gui agents: A verifier-driven approach to practical deployment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.376080Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:be836d26de44837b3700672b42838229bda4a9e8485c677c874d9dfee780f5ef","observation_id":"c3ff140a-fc9a-4c15-8714-ae237dc91a58","resolution":{"observed_at":"2026-08-06T21:11:18.376080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.380412Z","title":"Adversarial training for multimodal large language models against jailbreak attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.380412Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:c253f49cb64e66a14ebbefe920336e299b9b8283354b163d1c1d089ec0d448b9","observation_id":"8de1ea38-995d-4b38-a9f9-bd77082c4c72","resolution":{"observed_at":"2026-08-06T21:11:18.380412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15512","last_updated":"2025-04-26T16:17:55Z","snapshot_observed_at":"2026-07-06T21:12:46.642950Z","submitted_at":"2025-04-22T01:18:42Z","title":"T2VShield: Model-Agnostic Jailbreak Defense for Text-to-Video Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15512","snapshot_observed_at":"2026-08-06T21:11:18.384644Z","title":"T2vshield: Model-agnostic jailbreak defense for text-to-video models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.384644Z"},"links":{"cited_paper":"/paper/2504.15512","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:728580c5d5faa8323a77a5b302aaec7e03cee74d631a4dcd4842c1653493b98e","observation_id":"0334c2b0-ce0c-4df3-8685-b277757b0305","resolution":{"observed_at":"2026-08-06T21:11:18.384644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09295","last_updated":"2025-03-16T07:13:53Z","snapshot_observed_at":"2026-08-06T22:34:48.802494Z","submitted_at":"2024-07-12T14:30:05Z","title":"Systematic Categorization, Construction and Evaluation of New Attacks against Multi-modal Mobile GUI Agents","version":3},"cited_work":{"arxiv_id":"2407.09295","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.09295","snapshot_observed_at":"2026-08-06T21:11:18.500797Z","title":"Systematic Categorization, Construction and Evaluation of New Attacks against Multi-modal Mobile GUI Agents","venue":"cs.CR","work_id":"1228e99a-cdbd-4234-a922-0fd977173fc7","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.389891Z"},"links":{"cited_paper":"/paper/2407.09295","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:768753a07320ea99c72a0127c13cba2ae6076749ad421ea01b5b7648316102bc","observation_id":"e62e0738-dd3a-4849-a3c9-4e97dab12016","resolution":{"observed_at":"2026-08-06T21:11:18.508107Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:19.357052Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments,","venue":null,"work_id":"7bb7fee3-841f-490f-951d-a16563684362","year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.394933Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:460f526a0f5a824630f6084c7fe1cb31179c711039d2c169f4f2b5a86b4195fa","observation_id":"22c84498-ae68-4ee2-8d63-3a2b1ba9c841","resolution":{"observed_at":"2026-08-06T21:11:19.362586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.400008Z","title":"Webshop: Towards scalable real-world web interaction with grounded language agents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.400008Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:7f8d4bc2b42e59bbf0ed7abb35cdb12143d2d09a047b43d834f6a74ccfd805f2","observation_id":"c6f89e65-b4f7-4481-9c26-eca4875be3c4","resolution":{"observed_at":"2026-08-06T21:11:18.400008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08144","last_updated":"2024-06-13T11:51:37Z","snapshot_observed_at":"2026-07-06T15:26:58.583640Z","submitted_at":"2023-05-14T12:31:03Z","title":"Mobile-Env: Building Qualified Evaluation Benchmarks for LLM-GUI Interaction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08144","snapshot_observed_at":"2026-08-06T21:11:18.404873Z","title":"Mobile-env: Building qualified evaluation benchmarks for llm-gui interaction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.404873Z"},"links":{"cited_paper":"/paper/2305.08144","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:de5eb5f0590349c0117a83bc125998c29d4f40423c381fd0c2f2f615d44184e4","observation_id":"d3a27180-635a-4ac6-b828-1becd0260233","resolution":{"observed_at":"2026-08-06T21:11:18.404873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00993","last_updated":"2024-07-01T06:10:01Z","snapshot_observed_at":"2026-07-06T18:39:20.664293Z","submitted_at":"2024-07-01T06:10:01Z","title":"Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00993","snapshot_observed_at":"2026-08-06T21:11:18.409630Z","title":"Mobile-bench: An evaluation benchmark for llm-based mobile agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.409630Z"},"links":{"cited_paper":"/paper/2407.00993","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:05dbd5366883744dea3e71b49e5b9bc2421df4208fb20436fbf41014130620c0","observation_id":"006174bb-5f56-4930-8cdd-21ba4d173eb4","resolution":{"observed_at":"2026-08-06T21:11:18.409630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:11:18.415107Z","title":"Spa-bench: A comprehensive benchmark for smartphone agent evaluation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.415107Z"},"links":{"citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:7b8893ca6434c2905b83a9c1f675ebffc19eadba91c815c294351a6a06e433d3","observation_id":"a03d62ba-bf55-498e-a976-a0e5aac5f545","resolution":{"observed_at":"2026-08-06T21:11:18.415107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07572","last_updated":"2025-08-10T05:59:20Z","snapshot_observed_at":"2026-08-04T14:46:05.418102Z","submitted_at":"2025-01-13T18:58:07Z","title":"WebWalker: Benchmarking LLMs in Web Traversal","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07572","snapshot_observed_at":"2026-08-06T21:11:18.419497Z","title":"Webwalker: Benchmarking llms in web traver- sal,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:11:18.419497Z"},"links":{"cited_paper":"/paper/2501.07572","citing_paper":"/paper/2507.00841"},"observation_digest":"sha256:1533c755667f5057be376b130a847323f2a573bdab592f6140b98b5762adc755","observation_id":"7e132520-222a-414d-82c6-cbf8af697334","resolution":{"observed_at":"2026-08-06T21:11:18.419497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00841","last_updated":"2025-07-01T15:10:00Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T06:45:54.453824Z","submitted_at":"2025-07-01T15:10:00Z","title":"SafeMobile: Chain-level Jailbreak Detection and Automated Evaluation for Multimodal Mobile Agents"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 4 inbound Pith citation observations for arXiv:2507.00841."}