{"as_of":"2026-08-08T18:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:87779db485741f52de13e03a598f87be71f170de7a35946afe133287c90309dd","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:42:34.334089Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:34:41.371201Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T12:28:07.459324Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2506.12382","last_updated":"2026-04-27T08:32:16Z","snapshot_observed_at":"2026-08-02T04:53:57.144183Z","submitted_at":"2025-06-14T07:31:52Z","title":"Exploring the Secondary Risks of Large Language Models","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T09:40:58.067398Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2506.12382"},"observation_digest":"sha256:99fffff09314a7a9cbbe9f8ab97389ee5ac7658513b52e4cb298d8fac3e01588","observation_id":"0ac778f4-c436-4eab-ab2e-8f7db66007f3","resolution":{"observed_at":"2026-05-19T09:42:13.989933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-08-06T21:34:41.371201Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23844","last_updated":"2025-06-30T13:34:34Z","snapshot_observed_at":"2026-08-08T15:24:13.507722Z","submitted_at":"2025-06-30T13:34:34Z","title":"A Survey on Autonomy-Induced Security Risks in Large Model-Based Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:41.371201Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2506.23844"},"observation_digest":"sha256:73476bd9d92ac80bfcdae6f29483a2382c3b3ff1f95a79262af3fb3094e64c71","observation_id":"264fee2f-c180-46c9-9f0c-de7b6b451ea7","resolution":{"observed_at":"2026-08-06T21:34:41.371201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2509.07553","last_updated":"2026-04-03T02:36:28Z","snapshot_observed_at":"2026-07-06T22:26:22.911328Z","submitted_at":"2025-09-09T09:46:01Z","title":"VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-18T18:06:12.349285Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2509.07553"},"observation_digest":"sha256:37bd0203c7e38cf068d0b50735c19c36b2a6aa5251c4c0760460e622a323dc64","observation_id":"523b9fb1-1da7-4def-85b9-ddd66c16c86c","resolution":{"observed_at":"2026-05-18T18:06:42.621938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-08-03T21:09:11.014186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.16478","last_updated":"2026-07-20T11:57:11Z","snapshot_observed_at":"2026-08-08T04:23:14.885822Z","submitted_at":"2025-11-20T15:46:27Z","title":"Music Recommendation with Large Language Models: Challenges, Opportunities, and Evaluation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T21:09:11.014186Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2511.16478"},"observation_digest":"sha256:fe80b6f5a30d845123171fb814b13cebfbc00bd323b9b3b7b0e9bffc0d66546d","observation_id":"aec30d6b-d3d3-4614-91c4-54beb8bf53b5","resolution":{"observed_at":"2026-08-03T21:09:11.014186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2512.00412","last_updated":"2026-04-14T02:57:44Z","snapshot_observed_at":"2026-07-06T22:37:16.933664Z","submitted_at":"2025-11-29T09:45:03Z","title":"Red Teaming Large Reasoning Models","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T03:29:16.164423Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2512.00412"},"observation_digest":"sha256:48ff0956befee4e35e558696c51d680a5cb0a374c18a61f7205aebe13c73797a","observation_id":"df4f8f69-492f-4a02-8859-d6f5769654b6","resolution":{"observed_at":"2026-05-17T03:31:28.581073Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2601.18842","last_updated":"2026-05-13T07:11:36Z","snapshot_observed_at":"2026-08-01T18:25:13.403669Z","submitted_at":"2026-01-26T11:33:40Z","title":"GUIGuard-Bench: Toward a General Evaluation for Privacy-Preserving GUI Agents","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T11:31:16.087579Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2601.18842"},"observation_digest":"sha256:4a6570af65501c4f291604066edc26c2ec5fac4f5bc78e78720cc1120f9374dd","observation_id":"b5a7936f-cb66-4614-83a7-704b221795ca","resolution":{"observed_at":"2026-05-16T11:32:48.311462Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2604.24348","last_updated":"2026-04-27T11:44:26Z","snapshot_observed_at":"2026-07-31T20:25:37.534799Z","submitted_at":"2026-04-27T11:44:26Z","title":"OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T03:51:54.310805Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2604.24348"},"observation_digest":"sha256:0ab68c3210f91315ecec0f5298cda36179f2c96ddc1fe0eabb7a04131a006d72","observation_id":"fd288ce0-6ab2-4df2-8f77-243cf9cb4db0","resolution":{"observed_at":"2026-05-11T21:56:11.643104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2605.20874","last_updated":"2026-05-20T08:13:16Z","snapshot_observed_at":"2026-08-07T00:36:40.996914Z","submitted_at":"2026-05-20T08:13:16Z","title":"Governance by Construction for Generalist Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T04:51:41.739358Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2605.20874"},"observation_digest":"sha256:9dee98057c9c8e0e470c7ace5236f5f2b17414af742a4842a058dcde8b8bb0a5","observation_id":"7b5d2f42-792d-4a94-ab49-0c71b8127d2e","resolution":{"observed_at":"2026-05-21T04:53:58.013167Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2605.23989","last_updated":"2026-05-17T10:26:37Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-17T10:26:37Z","title":"Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-30T19:18:40.244556Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2605.23989"},"observation_digest":"sha256:06802fa40f331b2a5571e10f5b2b8619ccc75d97b18fd79d78fcb820a1e9dec5","observation_id":"026806d4-6102-4363-8424-3a12856b2553","resolution":{"observed_at":"2026-06-30T19:45:01.572187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":"2506.01616","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-07-03T12:28:07.459324Z","title":"Mla-trust: Benchmarking trustworthiness of multimodal llm agents in gui environments","venue":null,"work_id":"c0996702-4610-4d5d-9234-3cb6f7a5c6a3","year":2025},"citing_paper":{"arxiv_id":"2606.12666","last_updated":"2026-06-16T03:15:00Z","snapshot_observed_at":"2026-07-30T01:01:38.589980Z","submitted_at":"2026-06-10T20:48:39Z","title":"CAPED: Context-Aware Privacy Exposure Defense for Mobile GUI Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T09:00:10.153170Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2606.12666"},"observation_digest":"sha256:00a55208f7fbf25cfc10f738b72375fae95df916783162ceac0a2c8da09528d8","observation_id":"32027b2f-b83e-496b-a0d2-92207bcd67a3","resolution":{"observed_at":"2026-07-03T12:28:07.460850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01616","snapshot_observed_at":"2026-08-03T11:50:48.700362Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29199","last_updated":"2026-07-31T09:18:55Z","snapshot_observed_at":"2026-08-06T16:41:38.516023Z","submitted_at":"2026-07-31T09:18:55Z","title":"Alignment Is Local: A Paired Diagnostic for GUI Agents under User-Side Persuasion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T11:50:48.700362Z"},"links":{"cited_paper":"/paper/2506.01616","citing_paper":"/paper/2607.29199"},"observation_digest":"sha256:aaad51d1b4070f88f9fe94e4bc61eba908fd4223d380eec89a650d12cab55c58","observation_id":"abc1ed42-32f8-4e7b-b357-2d381601b7ff","resolution":{"observed_at":"2026-08-03T11:50:48.700362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01616/citation-record","integrity":"/paper/2506.01616/integrity","json":"/paper/2506.01616/citation-record.json","paper":"/paper/2506.01616"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:42:32.631650Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.631650Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:5040a7dd79729a2fdeafa29f76be64c6a0a213a7bcca3f24a820ad1abcd4c891","observation_id":"b0192ec2-8633-4c0c-a7e7-c28e2de56f8e","resolution":{"observed_at":"2026-08-07T11:42:32.631650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.651411Z","title":"Gemini 2.0 flash model card,","venue":null,"work_id":"6508a4d1-a008-481e-bacd-76bd50672189","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.651030Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:acbe0ccf412b0db4f82d146854cb5c40301ba26ee3440d9c1cabb683f62d0703","observation_id":"51fbccb8-2d75-4f0e-bb85-4851de27047a","resolution":{"observed_at":"2026-08-07T11:42:35.656884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.634854Z","title":"The claude 3 model family: Opus, sonnet, haiku,","venue":null,"work_id":"c1053796-b92e-49ae-b1ef-a5f5bece22ea","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.672386Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:d38c840003257f3875b5dbe2bced3e3d7103dd92107e6abb2a729439e8d838b0","observation_id":"1f42dbaf-c2b6-45b9-a41e-257e98bef35a","resolution":{"observed_at":"2026-08-07T11:42:35.640303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07073","last_updated":"2024-10-10T17:59:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-09T17:16:22Z","title":"Pixtral 12B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07073","snapshot_observed_at":"2026-08-07T11:42:32.693528Z","title":"Pixtral 12b,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.693528Z"},"links":{"cited_paper":"/paper/2410.07073","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:056a25cab984c793cb97943849d809abe9b29e5ccc8bf55dad47d9fd0c10a68d","observation_id":"90b58b83-1de5-45ec-880c-1581d6b3e514","resolution":{"observed_at":"2026-08-07T11:42:32.693528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08268","last_updated":"2023-10-11T16:17:20Z","snapshot_observed_at":"2026-07-06T15:03:25.644795Z","submitted_at":"2023-03-14T23:01:27Z","title":"Chat with the Environment: Interactive Multimodal Perception Using Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08268","snapshot_observed_at":"2026-08-07T11:42:32.714754Z","title":"Chat with the environment: Interactive multimodal perception using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.714754Z"},"links":{"cited_paper":"/paper/2303.08268","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:1a1b914f9d227ab718bdacb0413ae3df4126b41346f1d4b60d407673abdf29f0","observation_id":"d94bb0c9-0ddc-4240-ae38-b04ffcef4434","resolution":{"observed_at":"2026-08-07T11:42:32.714754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13255","last_updated":"2023-12-07T05:36:26Z","snapshot_observed_at":"2026-08-02T03:40:39.621359Z","submitted_at":"2023-10-20T03:22:05Z","title":"Steve-Eye: Equipping LLM-based Embodied Agents with Visual Perception in Open Worlds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13255","snapshot_observed_at":"2026-08-07T11:42:32.742298Z","title":"Steve-eye: Equipping llm-based embodied agents with visual perception in open worlds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.742298Z"},"links":{"cited_paper":"/paper/2310.13255","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:28f46c08f2c015e64bd601c5996c86af6d723e2252e2c818dc79e00974772fef","observation_id":"d6cd318a-e863-4908-8f01-2975ea30476c","resolution":{"observed_at":"2026-08-07T11:42:32.742298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06327","last_updated":"2024-08-12T17:44:17Z","snapshot_observed_at":"2026-08-07T04:07:56.293097Z","submitted_at":"2024-08-12T17:44:17Z","title":"VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06327","snapshot_observed_at":"2026-08-07T11:42:32.768449Z","title":"Visualagentbench: Towards large multimodal models as visual foundation agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.768449Z"},"links":{"cited_paper":"/paper/2408.06327","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:2f2e1c6b168739cc1f334ffe9b400ae1f7d49d2474a9c64e711cd7d915cd0461","observation_id":"59419a14-fc70-47db-ace9-0f0f706761aa","resolution":{"observed_at":"2026-08-07T11:42:32.768449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15116","last_updated":"2024-02-23T06:04:23Z","snapshot_observed_at":"2026-07-06T17:34:24.337596Z","submitted_at":"2024-02-23T06:04:23Z","title":"Large Multimodal Agents: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15116","snapshot_observed_at":"2026-08-07T11:42:32.798379Z","title":"Large multimodal agents: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.798379Z"},"links":{"cited_paper":"/paper/2402.15116","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:f839d646358ddca2c423f1686d989919a6b0808a2bce69f3005120a63f561191","observation_id":"8d38a11e-35f0-43d8-a017-45eca82fbdc1","resolution":{"observed_at":"2026-08-07T11:42:32.798379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03568","last_updated":"2024-01-25T21:20:27Z","snapshot_observed_at":"2026-07-30T06:39:40.880794Z","submitted_at":"2024-01-07T19:11:18Z","title":"Agent AI: Surveying the Horizons of Multimodal Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03568","snapshot_observed_at":"2026-08-07T11:42:32.859252Z","title":"Agent ai: Surveying the horizons of multimodal interaction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.859252Z"},"links":{"cited_paper":"/paper/2401.03568","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:13c0651c7b27efd42332c05a0159b6c262c8ca248b6ff5776b4d7cdd9e35cfb2","observation_id":"4c05c70e-0a23-4e0f-be7a-9fe7db43e7cc","resolution":{"observed_at":"2026-08-07T11:42:32.859252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-07T11:03:34.753698Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-07T11:42:32.881419Z","title":"Webvoyager: Building an end-to-end web agent with large multimodal models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.881419Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:da1134172f57839c8315aa8a3fac199251b84e2beac2511e38e2b04adc0fe4aa","observation_id":"1c0f580c-e3ad-480a-b9ef-86ce9a0428c5","resolution":{"observed_at":"2026-08-07T11:42:32.881419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13771","last_updated":"2026-07-05T07:51:04Z","snapshot_observed_at":"2026-08-04T19:11:48.797552Z","submitted_at":"2023-12-21T11:52:45Z","title":"AppAgent: Multimodal Agents as Smartphone Users","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13771","snapshot_observed_at":"2026-08-07T11:42:32.902989Z","title":"Appagent: Multimodal agents as smartphone users,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.902989Z"},"links":{"cited_paper":"/paper/2312.13771","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:bad568aebdc83ca40137e90baf4b2e7d31ef480873a657e4de1fc2ea3f662a4e","observation_id":"a01ae670-76c0-4411-9e86-1048cc89327c","resolution":{"observed_at":"2026-08-07T11:42:32.902989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16158","last_updated":"2024-04-18T06:53:38Z","snapshot_observed_at":"2026-08-05T03:22:24.562938Z","submitted_at":"2024-01-29T13:46:37Z","title":"Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16158","snapshot_observed_at":"2026-08-07T11:42:32.924240Z","title":"Mobile-agent: Autonomous multi-modal mobile device agent with visual perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.924240Z"},"links":{"cited_paper":"/paper/2401.16158","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:33620b607f5707363a9576967623693c59f1950d9dc34570ee637868415d3a30","observation_id":"f6c743ab-99ed-49e8-ba22-12b1b4c53dbf","resolution":{"observed_at":"2026-08-07T11:42:32.924240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01014","last_updated":"2024-06-03T05:50:00Z","snapshot_observed_at":"2026-08-06T22:15:02.337988Z","submitted_at":"2024-06-03T05:50:00Z","title":"Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01014","snapshot_observed_at":"2026-08-07T11:42:32.948785Z","title":"Mobile-agent-v2: Mobile device operation assistant with effective navigation via multi-agent collaboration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.948785Z"},"links":{"cited_paper":"/paper/2406.01014","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:7e1f0e0ea8d47c7030029306b4130b2ac901a1445a86e964b3c1900d8075b394","observation_id":"149c1d36-29e9-4477-9dd0-f1345bbf87dc","resolution":{"observed_at":"2026-08-07T11:42:32.948785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11733","last_updated":"2025-01-28T16:58:02Z","snapshot_observed_at":"2026-08-07T18:11:16.595464Z","submitted_at":"2025-01-20T20:35:46Z","title":"Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11733","snapshot_observed_at":"2026-08-07T11:42:32.973269Z","title":"Mobile-agent-e: Self-evolving mobile assistant for complex tasks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.973269Z"},"links":{"cited_paper":"/paper/2501.11733","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:c6d2c634ca67047b56a88ea88e402813d7ee33415197d381d93fbabfce114932","observation_id":"b8b15dd0-fbfb-4c34-b722-8c5182ea0749","resolution":{"observed_at":"2026-08-07T11:42:32.973269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-07T11:42:32.995013Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:32.995013Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:4809949ec9adee56ef78364bb2182eccd70a3724dcb94ec1dbddfbd8fef4f9b1","observation_id":"2ea8d8c1-98c1-41c9-b0e1-8a77d39622d5","resolution":{"observed_at":"2026-08-07T11:42:32.995013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05955","last_updated":"2024-04-09T02:29:39Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:29:39Z","title":"VisualWebBench: How Far Have Multimodal LLMs Evolved in Web Page Understanding and Grounding?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05955","snapshot_observed_at":"2026-08-07T11:42:33.016850Z","title":"Visualwebbench: How far have multimodal llms evolved in web page understanding and grounding?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.016850Z"},"links":{"cited_paper":"/paper/2404.05955","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:daf9664d63d4bdbf6552addfc4f0ae614e8c1827b924890300ff80848343de98","observation_id":"58f43906-2a00-43a5-9296-71b30caad99b","resolution":{"observed_at":"2026-08-07T11:42:33.016850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12373","last_updated":"2024-07-16T06:19:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-18T07:58:33Z","title":"WebCanvas: Benchmarking Web Agents in Online Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12373","snapshot_observed_at":"2026-08-07T11:42:33.038850Z","title":"Webcanvas: Benchmarking web agents in online environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.038850Z"},"links":{"cited_paper":"/paper/2406.12373","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:f8d9f9ae6f3fd1113fd1e724984ccfe59ad038c07aa68697f2d8f8e4a0329756","observation_id":"2b3f4c75-d2dd-4309-a2db-847a2f4f4cf2","resolution":{"observed_at":"2026-08-07T11:42:33.038850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.619420Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents,","venue":null,"work_id":"e0d8e9ab-cc3b-4df2-a3f1-772635901970","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.077219Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:a51bfc60fdf5905c81f44b3e6b2158d5815a18b12ad0c357a4fc2390b51afea4","observation_id":"b6efd011-5a9b-4c64-9ad2-56c558dde720","resolution":{"observed_at":"2026-08-07T11:42:35.623971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10143","last_updated":"2023-09-18T20:46:02Z","snapshot_observed_at":"2026-08-04T17:09:34.532246Z","submitted_at":"2023-09-18T20:46:02Z","title":"The Positive-Definite Completion Problem","version":1},"cited_work":{"arxiv_id":"2309.10143","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.10143","snapshot_observed_at":"2026-08-07T11:42:35.131838Z","title":"The Positive-Definite Completion Problem","venue":"math.FA","work_id":"48284f4b-d186-4ebf-8558-5244cb8d96ea","year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.108586Z"},"links":{"cited_paper":"/paper/2309.10143","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:9e174a5a27d4c5dfe9ba81cb094da61b8da659bb308627977d01195a39ff2766","observation_id":"88115221-051d-428c-ad1e-1d8407fa7238","resolution":{"observed_at":"2026-08-07T11:42:35.160742Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16465","last_updated":"2025-07-14T15:56:44Z","snapshot_observed_at":"2026-08-07T17:46:36.827833Z","submitted_at":"2025-02-26T12:31:16Z","title":"OS-Kairos: Adaptive Interaction for MLLM-Powered GUI Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16465","snapshot_observed_at":"2026-08-07T11:42:33.129535Z","title":"Os- kairos: Adaptive interaction for mllm-powered gui agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.129535Z"},"links":{"cited_paper":"/paper/2503.16465","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:a50e5de585aef7b3686c3de2d75c31afe8fbd3bea35185afcde0ae1d274338b5","observation_id":"213f8aa6-6738-490e-89d8-79fab063984b","resolution":{"observed_at":"2026-08-07T11:42:33.129535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08586","last_updated":"2025-02-12T17:19:36Z","snapshot_observed_at":"2026-08-08T04:30:32.472694Z","submitted_at":"2025-02-12T17:19:36Z","title":"Commercial LLM Agents Are Already Vulnerable to Simple Yet Dangerous Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08586","snapshot_observed_at":"2026-08-07T11:42:33.151323Z","title":"Commercial llm agents are already vulnerable to simple yet dangerous attacks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.151323Z"},"links":{"cited_paper":"/paper/2502.08586","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:3f305e5b33bb845bdd6aed64966ae944d05907b4191ac9a09926f497e264d11e","observation_id":"4de0b938-f923-4b0a-8e57-4b32cf438f03","resolution":{"observed_at":"2026-08-07T11:42:33.151323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08197","last_updated":"2025-02-26T03:24:58Z","snapshot_observed_at":"2026-07-06T19:31:23.072307Z","submitted_at":"2024-10-10T17:58:44Z","title":"From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08197","snapshot_observed_at":"2026-08-07T11:42:33.179393Z","title":"From exploration to mastery: Enabling llms to master tools via self-driven interactions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.179393Z"},"links":{"cited_paper":"/paper/2410.08197","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:845a418278b62d435e352faf5722335fce4fc023bcb0e2f1e3d09a693ac8f4ce","observation_id":"373eeb94-1219-4c1d-9fad-bde91477419e","resolution":{"observed_at":"2026-08-07T11:42:33.179393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.211463Z","title":"Agentdam: Privacy leakage evaluation for autonomous web agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.211463Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:82bd899b0513588608f3585f1b240b89f77c5d1a127e7b93dbbc394a2d3f5b06","observation_id":"444972f3-190f-4558-b62b-bf7ccd680d6c","resolution":{"observed_at":"2026-08-07T11:42:33.211463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.232181Z","title":"Towards trustworthy gui agents: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.232181Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:234f23d441c25574bf19ff7005b89f3929838275cb4332fe43314f40a269331e","observation_id":"76bd7d73-bebe-403b-81bf-2f66c536a251","resolution":{"observed_at":"2026-08-07T11:42:33.232181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.602327Z","title":"Ai-powered robots can be tricked into acts of violence,","venue":null,"work_id":"de1a6a22-44d4-493d-b2fa-d530eaf64c31","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.254892Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:cee037a1febd915c3deafd95ac2d528d7582b7508e324fef4dea100c1909f671","observation_id":"69a3638e-6bc9-45ab-91c3-b20690291bc4","resolution":{"observed_at":"2026-08-07T11:42:35.608567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10019","last_updated":"2024-10-05T06:50:15Z","snapshot_observed_at":"2026-08-06T04:21:24.397587Z","submitted_at":"2024-01-18T14:40:46Z","title":"R-Judge: Benchmarking Safety Risk Awareness for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10019","snapshot_observed_at":"2026-08-07T11:42:33.276048Z","title":"R-judge: Benchmarking safety risk awareness for llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.276048Z"},"links":{"cited_paper":"/paper/2401.10019","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:cfa693ff45ffe7e81364b57791df65865b3d7de4ae59c6bf0a226c75e9221d6c","observation_id":"ed95cab0-819a-4d59-b163-9176c90893d5","resolution":{"observed_at":"2026-08-07T11:42:33.276048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15817","last_updated":"2024-05-17T17:17:45Z","snapshot_observed_at":"2026-07-06T16:24:30.545494Z","submitted_at":"2023-09-25T17:08:02Z","title":"Identifying the Risks of LM Agents with an LM-Emulated Sandbox","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15817","snapshot_observed_at":"2026-08-07T11:42:33.307592Z","title":"Identifying the risks of lm agents with an lm-emulated sandbox,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.307592Z"},"links":{"cited_paper":"/paper/2309.15817","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:4775a53baf5c12777d84a87f135cfbc6d4495fea33925320790e1e3c7057b2d0","observation_id":"932cf7b5-82e0-4c12-9142-af15aa85b84b","resolution":{"observed_at":"2026-08-07T11:42:33.307592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13352","last_updated":"2024-11-24T22:04:23Z","snapshot_observed_at":"2026-07-06T18:33:32.806635Z","submitted_at":"2024-06-19T08:55:56Z","title":"AgentDojo: A Dynamic Environment to Evaluate Prompt Injection Attacks and Defenses for LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13352","snapshot_observed_at":"2026-08-07T11:42:33.346782Z","title":"Agentdojo: A dynamic environment to evaluate attacks and defenses for llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.346782Z"},"links":{"cited_paper":"/paper/2406.13352","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:e707e039b09d6f6a8f5bebdd9b0730fa1a7c3771b2f2ba92d5f8e2dadf4219f7","observation_id":"70068e19-bbd1-4515-b95c-696492d1afa9","resolution":{"observed_at":"2026-08-07T11:42:33.346782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.586910Z","title":"Aligned llms are not aligned browser agents,","venue":null,"work_id":"d99a50c1-802d-496f-849a-a90601497c72","year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.381673Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:70c5426e43982f1fd5eb0c4ac14b6aa5f4a710677dbf415bf72e81b65563139a","observation_id":"a6a48b9f-64e0-43b3-b6fc-736c4a032d87","resolution":{"observed_at":"2026-08-07T11:42:35.591773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.401642Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.401642Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:d7f7e4546ec5836f562fcbc7dac6b4ccff5a3f9c0101d079d4d06c65c73ddadd","observation_id":"d01aae15-96e5-4d0b-9f1a-a9ea4b2c8db3","resolution":{"observed_at":"2026-08-07T11:42:33.401642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-08T00:07:32.122707Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-07T11:42:33.433505Z","title":"How many unicorns are in this image? a safety evaluation benchmark for vision llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.433505Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:8a77cf14c7cb5fdb925da33aa0fc5dae1f8fac56973b9e7a3704d82d22ad3879","observation_id":"448ccc0f-a26a-4c91-ab4a-9b4750d221e9","resolution":{"observed_at":"2026-08-07T11:42:33.433505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12915","last_updated":"2024-01-23T17:07:18Z","snapshot_observed_at":"2026-07-06T17:19:31.847730Z","submitted_at":"2024-01-23T17:07:18Z","title":"Red Teaming Visual Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12915","snapshot_observed_at":"2026-08-07T11:42:33.455009Z","title":"Red teaming visual language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.455009Z"},"links":{"cited_paper":"/paper/2401.12915","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:9971e8420e0c7111f69e2b1b34083af237e3a228accc4b9d88df721ada325e03","observation_id":"9e82d4df-4156-413d-8cb6-c20e668115c6","resolution":{"observed_at":"2026-08-07T11:42:33.455009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.561086Z","title":"Multitrust: A comprehensive benchmark towards trustworthy multimodal large language models,","venue":null,"work_id":"eb353a45-c0c6-4b43-8a10-01904d2d8de7","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.476297Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:bdb5e37100aaa4bf9194df3136b7f41c2a3b1c7370ca69de641a7daf7d375958","observation_id":"a56f2271-a3df-4f32-87ea-508b0d3ac0af","resolution":{"observed_at":"2026-08-07T11:42:35.565998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02544","last_updated":"2025-09-05T09:21:10Z","snapshot_observed_at":"2026-08-08T05:48:26.856044Z","submitted_at":"2024-08-05T15:16:22Z","title":"Caution for the Environment: Multimodal LLM Agents are Susceptible to Environmental Distractions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02544","snapshot_observed_at":"2026-08-07T11:42:33.498378Z","title":"Caution for the environment: Multimodal agents are susceptible to environmental distractions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.498378Z"},"links":{"cited_paper":"/paper/2408.02544","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:21418f8f77331e3660f18e5f5f30bb7745074af53c4b54051fd3ef7c25ea833c","observation_id":"ee8890b0-3b36-492c-8951-bdce4cd1322a","resolution":{"observed_at":"2026-08-07T11:42:33.498378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.519896Z","title":"Mobilesafetybench: Evaluating safety of autonomous agents in mobile device control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.519896Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:8d3fbfd60c915a117e709ced82b9d367516c15e56d047eb4ed4bb46d121f5af2","observation_id":"9a59d0cc-58b3-45b4-98a5-4eaa03a6d04e","resolution":{"observed_at":"2026-08-07T11:42:33.519896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-07T11:42:33.548948Z","title":"The rise and potential of large language model based agents: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.548948Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:ea73d96d1b00bd17b12ba52066d20f9c1272adefc2920b7f69ce465964863334","observation_id":"223afa44-20b6-4b8e-858b-fb977338d684","resolution":{"observed_at":"2026-08-07T11:42:33.548948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.546047Z","title":"Cognitive architec- tures for language agents,","venue":null,"work_id":"7b1fa56c-27a2-4185-bf36-f829b880eb0a","year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.570249Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:3191dd881835da168a8c6ac3eee4ed044cd2f88fde95114a56cc29c58f0af9c4","observation_id":"50298a47-6967-4c1b-befb-69fbfec31c04","resolution":{"observed_at":"2026-08-07T11:42:35.550663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.531439Z","title":"Vipergpt: Visual inference via python execution for reasoning,","venue":null,"work_id":"224b1f92-6185-4cbb-8536-2d7b5565c58d","year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.606591Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:2b24b0ddd2a22468452089601ab491fa5fabd76fad05a3e79531fb07ac527298","observation_id":"f64a28bd-0e6c-4b7d-9188-11c97fbbbf33","resolution":{"observed_at":"2026-08-07T11:42:35.536128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.515718Z","title":"Chameleon: Plug-and-play compositional reasoning with large language models,","venue":null,"work_id":"0e7b7d23-0a3a-4415-a1c1-a4849f9e9189","year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.643057Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:56e9e12d235a2d878fa928ce0affe3394b43e4142e6af954efb28cf23ebb68ef","observation_id":"db6e8ac8-d582-41c4-88cd-114c35d4d976","resolution":{"observed_at":"2026-08-07T11:42:35.521029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.672003Z","title":"Hugginggpt: Solving ai tasks with chatgpt and its friends in hugging face,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.672003Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:0e7fc344c77773ba81e6fa45e321f72b0fb358f15427d1890c72336d41be2e79","observation_id":"f8eabefb-c52c-482c-af84-86a1ee746690","resolution":{"observed_at":"2026-08-07T11:42:33.672003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11381","snapshot_observed_at":"2026-08-07T11:42:33.692481Z","title":"Mm-react: Prompting chatgpt for multimodal reasoning and action,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.692481Z"},"links":{"cited_paper":"/paper/2303.11381","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:99ecd7e388b5a24d661f08429f06aaf8d3739964a14e6020c14c17df8ba14b79","observation_id":"bd4011c7-7988-4248-8389-bf726766b610","resolution":{"observed_at":"2026-08-07T11:42:33.692481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.491374Z","title":"An introduction to microsoft copilot,","venue":null,"work_id":"597f374f-84c5-4c51-89af-2ae8057289c7","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.714006Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:18b6784eab2885c5ddd408612a00919cc2b2e90f1c061a6d4bf21e4bed618dc9","observation_id":"6b589c43-ab41-4c9e-844f-8fcf586ed2dd","resolution":{"observed_at":"2026-08-07T11:42:35.495761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:42:33.735322Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.735322Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:341fa2425ebd6d3f830e1245ee582059ef73de79e48bd39f9dc7cdaab2dd9ef6","observation_id":"dd503f24-bdc1-4c00-8b14-00d50cca5717","resolution":{"observed_at":"2026-08-07T11:42:33.735322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:33.757941Z","title":"Improving image generation with better captions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.757941Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:761fc11ff32b3bc9ce7dcc7217a237c79836aed89213ee96e4455a7995b74441","observation_id":"78b27603-5ec6-4f11-ba85-22c42275fc17","resolution":{"observed_at":"2026-08-07T11:42:33.757941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T11:42:33.780135Z","title":"Visual chatgpt: Talking, drawing and editing with visual foundation models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.780135Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:fdd26e731be5aed3d3b37296326fc386ff8815bfb8cf9864dcc40fb2bd5538bd","observation_id":"55dd091a-4a61-48f6-9bcf-a79b6e1f5a87","resolution":{"observed_at":"2026-08-07T11:42:33.780135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00906","last_updated":"2025-04-01T15:40:27Z","snapshot_observed_at":"2026-07-06T21:02:28.100677Z","submitted_at":"2025-04-01T15:40:27Z","title":"Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.00906","snapshot_observed_at":"2026-08-07T11:42:33.802260Z","title":"Agent s2: A compositional generalist-specialist framework for computer use agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.802260Z"},"links":{"cited_paper":"/paper/2504.00906","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:798fa3492a751f419832d345c094e11ca102a17e4820fe479d20a18242e4317b","observation_id":"718ce5d8-1928-457d-a07a-b6561ba0ee61","resolution":{"observed_at":"2026-08-07T11:42:33.802260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23252","last_updated":"2025-03-08T23:37:49Z","snapshot_observed_at":"2026-07-06T19:42:25.742756Z","submitted_at":"2024-10-30T17:35:44Z","title":"Evaluating Cultural and Social Awareness of LLM Web Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23252","snapshot_observed_at":"2026-08-07T11:42:33.824262Z","title":"Evaluating cultural and social awareness of llm web agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.824262Z"},"links":{"cited_paper":"/paper/2410.23252","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:202d6ea35b4fad80dd5c5a450aa8b9b2873eb1e821900ca24f38f4720140f1e5","observation_id":"ea697270-1886-4d70-a867-2a1346ad5472","resolution":{"observed_at":"2026-08-07T11:42:33.824262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10196","last_updated":"2024-02-15T18:51:32Z","snapshot_observed_at":"2026-08-04T06:28:18.014892Z","submitted_at":"2024-02-15T18:51:32Z","title":"A Trembling House of Cards? Mapping Adversarial Attacks against Language Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10196","snapshot_observed_at":"2026-08-07T11:42:33.844167Z","title":"A trembling house of cards? mapping adversarial attacks against language agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.844167Z"},"links":{"cited_paper":"/paper/2402.10196","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:ff4c3ec708835e27682f498c8dee1337819d25cdae745bb70bad6459300c05c0","observation_id":"69fe411c-866a-4592-9402-9765861f448f","resolution":{"observed_at":"2026-08-07T11:42:33.844167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02691","last_updated":"2024-08-04T04:52:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-05T06:21:45Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02691","snapshot_observed_at":"2026-08-07T11:42:33.874483Z","title":"Injecagent: Benchmarking indirect prompt injections in tool-integrated large language model agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.874483Z"},"links":{"cited_paper":"/paper/2403.02691","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:6b3e82f48c89b90a2dfc5797b0e7dd7e064bdb242379ef9134f7b92fbaf7a74c","observation_id":"c1a6ef74-4f30-436a-8be2-6312e39575ca","resolution":{"observed_at":"2026-08-07T11:42:33.874483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11295","last_updated":"2025-03-12T20:54:00Z","snapshot_observed_at":"2026-08-06T11:52:38.289574Z","submitted_at":"2024-09-17T15:49:44Z","title":"EIA: Environmental Injection Attack on Generalist Web Agents for Privacy Leakage","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11295","snapshot_observed_at":"2026-08-07T11:42:33.904793Z","title":"Eia: Environmental injection attack on generalist web agents for privacy leakage,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.904793Z"},"links":{"cited_paper":"/paper/2409.11295","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:441af71a987120bff7060aa2bf22b3c16a2e7332b35e29df24140c99d84f72a9","observation_id":"70dac990-ffe5-4634-9672-79ef68675753","resolution":{"observed_at":"2026-08-07T11:42:33.904793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-07T11:42:33.931526Z","title":"Gpt-4v (ision) is a generalist web agent, if grounded,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.931526Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:08f38ca8b3a0a8c686f7413c98a82620d8cf3d289de8f925d01b13d4662c1040","observation_id":"608181d0-4092-4d95-9951-316fc7a8fdc0","resolution":{"observed_at":"2026-08-07T11:42:33.931526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-02T12:38:54.249632Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-08-07T11:42:33.953240Z","title":"Agentharm: A benchmark for measuring harmfulness of llm agents,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.953240Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:d30abe56ed245281db00656071643adfe9b1981dd0fc4e79440bbacad4724b06","observation_id":"9f7c962f-ba98-40db-a27c-ce9b3da6036c","resolution":{"observed_at":"2026-08-07T11:42:33.953240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02644","last_updated":"2025-05-30T03:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-03T16:30:47Z","title":"Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02644","snapshot_observed_at":"2026-08-07T11:42:33.973959Z","title":"Agent security bench (asb): Formalizing and benchmarking at- tacks and defenses in llm-based agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.973959Z"},"links":{"cited_paper":"/paper/2410.02644","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:ddf3dcda7367ce3c46f8e9561ccf660b4d1fdaadb0e3a236d488ebf3b77c1ddb","observation_id":"453ea8eb-5968-4b02-90c7-81632c60e4aa","resolution":{"observed_at":"2026-08-07T11:42:33.973959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-08-05T07:12:18.604381Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-08-07T11:42:33.995822Z","title":"St- webagentbench: A benchmark for evaluating safety and trustworthiness in web agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:33.995822Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:9f57139924f1cb1938aefcb7b8b7c06927cc70e75ccd130cb7bb4cd572d6a827","observation_id":"a5588d20-6ca3-4cb0-8fc6-26247e9c7b34","resolution":{"observed_at":"2026-08-07T11:42:33.995822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14470","last_updated":"2025-05-20T05:58:23Z","snapshot_observed_at":"2026-08-06T12:35:19.109481Z","submitted_at":"2024-12-19T02:35:15Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14470","snapshot_observed_at":"2026-08-07T11:42:34.018149Z","title":"Agent-safetybench: Evaluating the safety of llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.018149Z"},"links":{"cited_paper":"/paper/2412.14470","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:a9ab857c1a6c1f8f74cfffb3393a4a32c70ae0ff8848861ca1c96c16e893641d","observation_id":"a7f792d5-1235-4c28-9446-690af4e73f9a","resolution":{"observed_at":"2026-08-07T11:42:34.018149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.462022Z","title":"Dissecting adversarial robustness of multimodal lm agents,","venue":null,"work_id":"c4dbefba-e165-441f-9692-b10c5bee443d","year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.043522Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:f01f8aa5a8ec98e0dac13d01e69fedf483baea521a5095ff1d3c3bf3e30e79f9","observation_id":"feb6032e-6828-4491-bdee-121c427bae65","resolution":{"observed_at":"2026-08-07T11:42:35.467914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.446580Z","title":"Exploring the robustness of decision-level through adversarial attacks on llm-based embodied models,","venue":null,"work_id":"69b47974-e851-4a55-9bca-30a1d521965b","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.064792Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:8a6cc054da640eee65a09e4124c3e0239c2d7fcfd712fa8f66aa7e8c1529f15d","observation_id":"a1b4f668-1c2c-4a02-8c9c-3535b008bb86","resolution":{"observed_at":"2026-08-07T11:42:35.451542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19668","last_updated":"2024-05-30T03:38:31Z","snapshot_observed_at":"2026-08-05T09:29:57.087847Z","submitted_at":"2024-05-30T03:38:31Z","title":"AutoBreach: Universal and Adaptive Jailbreaking with Efficient Wordplay-Guided Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19668","snapshot_observed_at":"2026-08-07T11:42:34.095527Z","title":"Autobreach: Universal and adaptive jailbreaking with efficient wordplay- guided optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.095527Z"},"links":{"cited_paper":"/paper/2405.19668","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:4b0c14a2590fb8c8e648af99d79449694418303c033a13ad7d0dfd24c724d57e","observation_id":"2903d421-1a8e-4a1a-8b07-d67a46d176de","resolution":{"observed_at":"2026-08-07T11:42:34.095527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09013","last_updated":"2025-04-28T04:20:13Z","snapshot_observed_at":"2026-08-04T07:22:09.543265Z","submitted_at":"2024-09-13T17:41:12Z","title":"AI-LieDar: Examine the Trade-off Between Utility and Truthfulness in LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09013","snapshot_observed_at":"2026-08-07T11:42:34.147867Z","title":"Ai-liedar: Examine the trade-off between utility and truthfulness in llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.147867Z"},"links":{"cited_paper":"/paper/2409.09013","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:00a574a5ba07e81fcb03b42daea567b1c0b0314b0875284166072db8ded834cd","observation_id":"9bf83d3d-5c2c-4003-a8f0-ffc334934005","resolution":{"observed_at":"2026-08-07T11:42:34.147867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10924","last_updated":"2026-04-29T05:56:22Z","snapshot_observed_at":"2026-07-06T21:24:49.058355Z","submitted_at":"2025-05-16T06:56:42Z","title":"A Survey on the Safety and Security Threats of Computer-Using Agents: JARVIS or Ultron?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10924","snapshot_observed_at":"2026-08-07T11:42:34.170693Z","title":"A survey on the safety and security threats of computer-using agents: Jarvis or ultron?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.170693Z"},"links":{"cited_paper":"/paper/2505.10924","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:9cb13faf19c392d96cf4bc5762ad722d6802fd684880c11c83534eb325f413e7","observation_id":"96e618ba-0d0f-443e-a9e1-362f9ad95e1f","resolution":{"observed_at":"2026-08-07T11:42:34.170693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11281","last_updated":"2025-04-15T15:21:09Z","snapshot_observed_at":"2026-08-07T16:02:08.308014Z","submitted_at":"2025-04-15T15:21:09Z","title":"The Obvious Invisible Threat: LLM-Powered GUI Agents' Vulnerability to Fine-Print Injections","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11281","snapshot_observed_at":"2026-08-07T11:42:34.196721Z","title":"The obvious invisible threat: Llm- powered gui agents’ vulnerability to fine-print injections,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.196721Z"},"links":{"cited_paper":"/paper/2504.11281","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:0c25b8b54eb4b241b30a46141b8acf4d39fa5ff502c582c1fddbd83653a99492","observation_id":"d4f3d604-3347-46d1-9a55-af913c0b0a43","resolution":{"observed_at":"2026-08-07T11:42:34.196721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.431722Z","title":"Large multi-modal models for strong performance and efficient deployment,","venue":null,"work_id":"b11e1665-cf3c-4f77-9adc-6c50ac2f07ea","year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.218472Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:ba2a538d910ba58697561fb70100e5c484fac26dfb87ae6aadfb5f54313207ff","observation_id":"7d6a254d-c1a3-482e-b5e4-d212330de1f4","resolution":{"observed_at":"2026-08-07T11:42:35.436239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-07T11:42:34.239494Z","title":"Deepseek-vl2: Mixture-of-experts vision- language models for advanced multimodal understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.239494Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:97b74c94b68931cbab6f9a2b70c0370650bc43d8575f55badd5d79191f700253","observation_id":"ece3bf19-f58c-40d7-ab6a-baad12aec4c0","resolution":{"observed_at":"2026-08-07T11:42:34.239494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T11:42:34.261444Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.261444Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:f6c46a75b00f778be83d7a912324c911a8e34095c1f24ce353adb7cfacb38df4","observation_id":"35cf182c-a56d-466a-89a3-955c20040914","resolution":{"observed_at":"2026-08-07T11:42:34.261444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-07T11:42:34.285617Z","title":"Llava-onevision: Easy visual task transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.285617Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:6cef070a0ea72a956e4bb461bbd51590fc7fc763ad9a8353bbe86b61f0ee4c24","observation_id":"c8befabd-e994-4862-a7e2-f7d130544460","resolution":{"observed_at":"2026-08-07T11:42:34.285617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T11:42:34.312600Z","title":"Phi-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.312600Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:64c513444c316b460e037693151dd1f7afb1da4b6586e89528e1c0bd3120028c","observation_id":"e7a17782-87a1-4b0b-a5a5-5416f5b02d60","resolution":{"observed_at":"2026-08-07T11:42:34.312600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:42:35.416780Z","title":"Elemente der exakten erblichkeitslehre. 1909,","venue":null,"work_id":"0ecc78ab-192c-479b-80cf-24e7212c262c","year":1909},"citing_paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T11:42:34.334089Z"},"links":{"citing_paper":"/paper/2506.01616"},"observation_digest":"sha256:345a9f3c69adba51ca7c4519715823631c0c7ea267723330ab837f4d1513fafc","observation_id":"a1fe2f56-e41f-4c2b-bc8e-f52ccc6e6bf6","resolution":{"observed_at":"2026-08-07T11:42:35.421328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01616","last_updated":"2025-06-02T12:56:27Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T16:00:43.942253Z","submitted_at":"2025-06-02T12:56:27Z","title":"MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 11 inbound Pith citation observations for arXiv:2506.01616."}