{"as_of":"2026-08-19T20:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58f8f8c5216f073408c3be89ff4086d5c174d9c14e1c1569c852d96b53f1e948","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T09:58:33.074127Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.07474/citation-record","integrity":"/paper/2607.07474/integrity","json":"/paper/2607.07474/citation-record.json","paper":"/paper/2607.07474"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.828083Z","title":"AgentDojo: A dynamic environment to evaluate prompt injection attacks and defenses for LLM agents,","venue":null,"work_id":"cb1f4044-3232-496f-920f-b1417820edb1","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:b5aa805f80b9a15f426ddc3e499d8b7d9304daa6ad83d63dc09ed1f9dfca4b33","observation_id":"f329a4e4-e2ab-4405-a5ab-19bc81ea1324","resolution":{"observed_at":"2026-07-09T10:06:09.830115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09527","last_updated":"2022-11-17T13:43:20Z","snapshot_observed_at":"2026-08-18T00:11:55.170013Z","submitted_at":"2022-11-17T13:43:20Z","title":"Ignore Previous Prompt: Attack Techniques For Language Models","version":1},"cited_work":{"arxiv_id":"2211.09527","doi":"10.48550/arxiv.2211.09527","metadata_source":"pith","pith_arxiv_id":"2211.09527","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ignore Previous Prompt: Attack Techniques For Language Models","venue":"cs.CL","work_id":"a7c5b6ec-3407-4330-96c8-3fc58e7d410b","year":2022},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"cited_paper":"/paper/2211.09527","citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:4f9488c0c7747cae4c8a80722d80998b59da3bc53303eba6ec7d0ed33a86dbb0","observation_id":"5e77a14b-ae83-4d8e-b068-d15d8b446ab0","resolution":{"observed_at":"2026-07-09T10:06:09.426173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-24T11:53:03.018758+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T11:53:03.018758+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.833404Z","title":"InjecAgent: Benchmark- ing indirect prompt injections in tool-integrated large language model agents,","venue":null,"work_id":"20e712c8-9b7d-4d2d-8679-37b09ac70229","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:20d3c5b5405872e1a9ae393c754c5e6faea57cd28be099bf74670df3fe6b7772","observation_id":"6a4796d0-893d-43c6-b4cd-ee67e3a4962f","resolution":{"observed_at":"2026-07-09T10:06:09.835226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.830868Z","title":"ADVERSA: Mea- suring multi-turn guardrail degradation and judge reliability in large language models,","venue":null,"work_id":"f97c50e9-22ef-43f2-bdb7-89fcd67673df","year":2026},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:018abd0b612f6e88ac7251bdb152b81ea680c7389e00abfa459877ded11bc268","observation_id":"629a4ee0-7691-40b8-aae4-babea257c536","resolution":{"observed_at":"2026-07-09T10:06:09.832758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.839832Z","title":"JailbreakBench: An open robustness benchmark for jailbreaking large language models,","venue":null,"work_id":"7f35d750-33d2-4b35-8e5c-6d52363b34c9","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:e901b918ecba97be84e1648672119fc979aabe39fb29acef31385eb0ce49464b","observation_id":"12f48316-5f7c-4eff-b2e3-80f028c3c7f4","resolution":{"observed_at":"2026-07-09T10:06:09.841993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.842678Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":"b5b69df3-2e25-4565-aa7e-9a50f9831050","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:f01f3705f3450cab975b1c2de53896f17418d189d363a0c111b0d114e06e74de","observation_id":"f26b4ddd-02a2-4902-8427-e8f34dc086a2","resolution":{"observed_at":"2026-07-09T10:06:09.844835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.829047Z","title":"Judging LLM-as-a-judge with MT-Bench and chatbot arena,","venue":null,"work_id":"6df2e6d9-22f1-4dff-bb4e-67490f5a73ee","year":2023},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:fb4a55a89740e451808285da168ec969c51a1b79e8a28d38505fc44c7f56a56c","observation_id":"136221e8-08cf-4653-beec-facdc9664000","resolution":{"observed_at":"2026-07-09T10:06:09.830468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14470","last_updated":"2025-05-20T05:58:23Z","snapshot_observed_at":"2026-08-06T12:35:19.109481Z","submitted_at":"2024-12-19T02:35:15Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","version":2},"cited_work":{"arxiv_id":"2412.14470","doi":"10.48550/arxiv.2412.14470","metadata_source":"pith","pith_arxiv_id":"2412.14470","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent-SafetyBench: Evaluating the Safety of LLM Agents","venue":"cs.CL","work_id":"96afb8b9-0e7e-442c-93b1-6638599fc041","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"cited_paper":"/paper/2412.14470","citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:b99552fbf380e317ef4878b458b5b6717fe242a6a44d3f017e6bd6e926fe9cf3","observation_id":"dfdb03d1-e563-472f-ad8e-9a70e235cd4e","resolution":{"observed_at":"2026-07-09T10:06:09.420192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:24.185748+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:24.185748+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.835492Z","title":"AgentHarm: A benchmark for measuring harmfulness of LLM agents,","venue":null,"work_id":"05382439-6436-4ca8-b054-30700d5c8c42","year":2025},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:a0a87813bff5d188e85efde7e8026a21728047c0161476bd97e1fedc71acb8db","observation_id":"358c93f0-d47b-451d-a369-bf82be8f779e","resolution":{"observed_at":"2026-07-09T10:06:09.836959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.831173Z","title":"Taxonomy of risks posed by language models,","venue":null,"work_id":"1cdb4d22-4fca-4e50-852d-767be690e10f","year":2022},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:a03c7f628ba4f766ac2a4e2a95045de4cd7b87b05e63f34dde903954938489c1","observation_id":"f401d6e1-d70b-4686-ace5-70b10ea3a7b9","resolution":{"observed_at":"2026-07-09T10:06:09.832590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.845640Z","title":"Identifying the risks of LM agents with an LM-emulated sandbox,","venue":null,"work_id":"9f770141-a4ea-4154-9b10-e89fec1e3378","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:8e137e55986f062b8c930c0014ef30f19b23c35c7a224b94b26fa3875aa45d7f","observation_id":"f76259b2-1058-4ee6-9a6f-93fa6e66306a","resolution":{"observed_at":"2026-07-09T10:06:09.847250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.837617Z","title":"R-Judge: Benchmarking safety risk awareness for LLM agents,","venue":null,"work_id":"e14ff642-adfa-4258-8b80-a068af466747","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:9b17d5b66667f42af89580dead7ccb5d14a73c9bbbf2bec342043d9abe3f8ea3","observation_id":"6c5ff330-47e1-4e86-83ba-2d886cc74d0d","resolution":{"observed_at":"2026-07-09T10:06:09.838988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14720","last_updated":"2024-03-20T15:26:23Z","snapshot_observed_at":"2026-08-18T16:24:31.099895Z","submitted_at":"2024-03-20T15:26:23Z","title":"Defending Against Indirect Prompt Injection Attacks With Spotlighting","version":1},"cited_work":{"arxiv_id":"2403.14720","doi":"10.48550/arxiv.2403.14720","metadata_source":"pith","pith_arxiv_id":"2403.14720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Defending Against Indirect Prompt Injection Attacks With Spotlighting","venue":"cs.CR","work_id":"c18cd975-e731-4e0f-a99f-a37d846cdd31","year":2024},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"cited_paper":"/paper/2403.14720","citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:088f853d4aa54ff9b734eea8bb41715f67a112602703958cafb13c05a46e4c98","observation_id":"be88d3f4-7474-477d-8862-968b54c65ca5","resolution":{"observed_at":"2026-07-09T10:06:09.423395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.835821Z","title":"Weighted kappa: Nominal scale agreement provision for scaled disagreement or partial credit,","venue":null,"work_id":"2524e66d-0d71-45e6-b4f1-a2e39f633388","year":1968},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:dee811c0a4d1c8dda9133d757cb458d4a102809a302c6de88a7fa1a4dfb31ba9","observation_id":"7ca6f8d6-ce35-4843-bc70-f732e0778ede","resolution":{"observed_at":"2026-07-09T10:06:09.837386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:06:09.848262Z","title":"Computing Krippendorff’s alpha-reliability,","venue":null,"work_id":"8c345a4f-43b2-4647-88c0-03c600221751","year":2011},"citing_paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-09T09:58:33.074127Z"},"links":{"citing_paper":"/paper/2607.07474"},"observation_digest":"sha256:322eee476e897f4075852703271ba320920a90864ce4e4c64f4324bb95c041b5","observation_id":"0b491060-caf6-4740-a192-978b62316712","resolution":{"observed_at":"2026-07-09T10:06:09.850156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.07474","last_updated":"2026-07-08T14:38:01Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-19T14:07:42.629382Z","submitted_at":"2026-07-08T14:38:01Z","title":"Beyond Attack-Success Rate: Action-Graded Severity Scale for Tool-Using AI Agents"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":3,"verified_fuzzy":12},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2607.07474."}