{"as_of":"2026-08-07T19:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38ce3c4e5451ae9d69c224c33182c22e3cea7867e0d605d2223dad0fd770680a","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:50:00.253920Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:48:36.924294Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:54:22.258152Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"cited_work":{"arxiv_id":"2506.09600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09600","snapshot_observed_at":"2026-06-30T07:54:22.258152Z","title":"Effective red- teaming of policy-adherent agents","venue":null,"work_id":"64490ab8-286e-4e6d-9b7f-29d09db47429","year":2025},"citing_paper":{"arxiv_id":"2510.04265","last_updated":"2026-05-12T01:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-05T16:14:03Z","title":"Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-18T10:04:39.223895Z"},"links":{"cited_paper":"/paper/2506.09600","citing_paper":"/paper/2510.04265"},"observation_digest":"sha256:bbdbdb105577ba54893e7cdc8904745b52a5634ee7a484b829b0f90133101249","observation_id":"29492dc8-2762-4be4-a9ef-17672f85925e","resolution":{"observed_at":"2026-05-18T10:06:13.730575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"cited_work":{"arxiv_id":"2506.09600","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09600","snapshot_observed_at":"2026-06-30T07:54:22.258152Z","title":"Effective red- teaming of policy-adherent agents","venue":null,"work_id":"64490ab8-286e-4e6d-9b7f-29d09db47429","year":2025},"citing_paper":{"arxiv_id":"2606.29225","last_updated":"2026-06-28T06:27:36Z","snapshot_observed_at":"2026-08-07T13:05:21.494072Z","submitted_at":"2026-06-28T06:27:36Z","title":"PolicyGuard: A Dialogue-Grounded Sub-Agent Verifier for Policy Adherence in LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-30T07:48:36.924294Z"},"links":{"cited_paper":"/paper/2506.09600","citing_paper":"/paper/2606.29225"},"observation_digest":"sha256:083559777c25f52f046dfdf07b48582cfba86bcca019c2c66e118bb1c5a86758","observation_id":"e24b196a-a0fd-4f1c-8ca4-5f9ae0e3084f","resolution":{"observed_at":"2026-06-30T07:54:22.260097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09600/citation-record","integrity":"/paper/2506.09600/integrity","json":"/paper/2506.09600/citation-record.json","paper":"/paper/2506.09600"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.119981Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.119981Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:cac8d2389d253bb0241b1890519ec9e99c23c0b35fa21d65bdd9b46b44fc91fa","observation_id":"a9fe4ffe-27a7-4b2d-bac8-777d4d8dd59c","resolution":{"observed_at":"2026-08-07T04:50:00.119981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-02T12:38:54.249632Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09024","snapshot_observed_at":"2026-08-07T04:50:00.124363Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.124363Z"},"links":{"cited_paper":"/paper/2410.09024","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:78eb47897ba466f0c74d1f152edfd1c3fb165910b6a21043b5a15147c0c981dd","observation_id":"ed34efe0-0318-4a5e-a5e3-dc1c3f58dbd8","resolution":{"observed_at":"2026-08-07T04:50:00.124363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15546","last_updated":"2025-09-12T11:24:08Z","snapshot_observed_at":"2026-08-07T16:00:23.396072Z","submitted_at":"2025-04-22T02:52:08Z","title":"A Framework for Testing and Adapting REST APIs as LLM Tools","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15546","snapshot_observed_at":"2026-08-07T04:50:00.129367Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.129367Z"},"links":{"cited_paper":"/paper/2504.15546","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:ecd5d17f7df98296cdbb8dd60fb60db493dc9df7fe6fc0863e33fcd82f5feed6","observation_id":"5bd98dfd-fade-4c92-993d-2104cf826649","resolution":{"observed_at":"2026-08-07T04:50:00.129367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:50:00.133366Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.133366Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:9eb7fd068a8ede08645b2254b9b8286cb1f2ebfdb77ca48d9fccedf1d025ab99","observation_id":"03ed9a8b-08c1-47cf-a062-174d7e1d1cab","resolution":{"observed_at":"2026-08-07T04:50:00.133366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:50:00.137097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.137097Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:fa0b67c8c54836704413f8b311cced0feef5756940d53eccfdb4e0bd17520fd1","observation_id":"a98cffe2-f85d-496d-9947-cd94c9849bc6","resolution":{"observed_at":"2026-08-07T04:50:00.137097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.983210Z","title":null,"venue":null,"work_id":"23f8294b-51d4-4d4d-8404-db9aa78e76c6","year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.140744Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:0e9ad44a628000220b9aa71975a1df85c46e2fc0fdb9dca20234f2b8d7b166a9","observation_id":"1e9eb559-74f2-464a-8fe8-116158765a52","resolution":{"observed_at":"2026-08-07T04:50:00.987004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.972218Z","title":null,"venue":null,"work_id":"b41ba255-9dc6-4fe7-92e6-82a96716ea57","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.144239Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:7e959b9ef10258f28e25b862294e5c9606a9f8e7288c05842ea22adce4447abd","observation_id":"e6252988-2705-441d-be6b-a23da52a6621","resolution":{"observed_at":"2026-08-07T04:50:00.976219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:50:00.147390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.147390Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:8057a1a31137a8389d2a0adfe3f9165be02092d4ea82501582144db5944e871e","observation_id":"2d02d8c2-ef73-4a6e-9b5b-998a49c59faf","resolution":{"observed_at":"2026-08-07T04:50:00.147390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.150733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.150733Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:b39a3a76d245cf45029d7de04135b7e1f370749b9ea062ae27b16f390764e6db","observation_id":"0fc1f222-66e5-48a6-9d06-cccaa70e343d","resolution":{"observed_at":"2026-08-07T04:50:00.150733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.12491","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.667007Z","title":null,"venue":null,"work_id":"57e6bb95-1be0-4ffd-97ca-ac43cad8c5b1","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.154869Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:db4d15d62c781b4a7421d5ed1c6cf8f800fbd67b0ea2852b3db948a92409328a","observation_id":"48730d43-8fe6-4f01-a378-2c588ee6b58a","resolution":{"observed_at":"2026-08-07T04:50:00.672247Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.961849Z","title":null,"venue":null,"work_id":"bd3dc95c-aaea-484f-880d-54cdca032df6","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.158262Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:01e53f01d573ac95a712f3591db58a784869ac340b0151a1b8066c4642edba93","observation_id":"986a60bd-ecac-46ec-ba2d-f5e102ed3cfc","resolution":{"observed_at":"2026-08-07T04:50:00.965469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04124","last_updated":"2023-11-07T16:50:33Z","snapshot_observed_at":"2026-08-02T11:30:46.576643Z","submitted_at":"2023-11-07T16:50:33Z","title":"Unveiling Safety Vulnerabilities of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04124","snapshot_observed_at":"2026-08-07T04:50:00.161709Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.161709Z"},"links":{"cited_paper":"/paper/2311.04124","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:29c634b5738a173101dd8e06a6ab7012c3cfd74e628cea27487a80d55a4110c5","observation_id":"7ceccfad-f25e-486e-adc7-2455580e1072","resolution":{"observed_at":"2026-08-07T04:50:00.161709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.950457Z","title":null,"venue":null,"work_id":"b9a03dba-0f42-401d-b7ca-d51a44bfcddf","year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.165546Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:708a9a0611210053894fac6116e89cfc61e0e0406fca71fa5174e97815c4e3f5","observation_id":"cc16bd91-aabd-4430-a712-cd7800f2b6f4","resolution":{"observed_at":"2026-08-07T04:50:00.953787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06703","last_updated":"2026-06-04T09:59:28Z","snapshot_observed_at":"2026-08-05T07:12:18.604381Z","submitted_at":"2024-10-09T09:13:38Z","title":"ST-WebAgentBench: A Benchmark for Evaluating Safety and Trustworthiness in Web Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06703","snapshot_observed_at":"2026-08-07T04:50:00.168901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.168901Z"},"links":{"cited_paper":"/paper/2410.06703","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:456029d785b187ba9e98a93121eae2434021e47db252fc1b6213be73250bc0f1","observation_id":"6c005901-1f7d-42ed-895b-fca8e3ed9781","resolution":{"observed_at":"2026-08-07T04:50:00.168901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08669","last_updated":"2025-06-17T17:50:44Z","snapshot_observed_at":"2026-08-07T17:12:14.445837Z","submitted_at":"2025-03-11T17:53:02Z","title":"SOPBench: Evaluating Language Agents at Following Standard Operating Procedures and Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08669","snapshot_observed_at":"2026-08-07T04:50:00.172498Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.172498Z"},"links":{"cited_paper":"/paper/2503.08669","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:4252a6521358c6253ce95240d645e59013c45184b33c1f47abffa5af5186196e","observation_id":"d2052270-87ab-4262-b1ae-ae4e9432038d","resolution":{"observed_at":"2026-08-07T04:50:00.172498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T04:50:00.176032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.176032Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:971beb6f6036b29d9132b8ec8c06bc1011ca64725e11fb4338355b1d85af91c3","observation_id":"1fc9cdf3-3095-4c91-9b47-b3ec89dd02ca","resolution":{"observed_at":"2026-08-07T04:50:00.176032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02777","last_updated":"2024-01-30T07:02:30Z","snapshot_observed_at":"2026-08-02T18:12:51.901453Z","submitted_at":"2024-01-05T12:26:46Z","title":"From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02777","snapshot_observed_at":"2026-08-07T04:50:00.179402Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.179402Z"},"links":{"cited_paper":"/paper/2401.02777","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:2e9ce131ebdb679165d585f2b10f7d59cd23c5aa73f3539881139a5483c93951","observation_id":"45a07ed6-ae4e-4bc8-8523-8826db4d0170","resolution":{"observed_at":"2026-08-07T04:50:00.179402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-07T04:50:00.182946Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.182946Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:c8cf12c18f235b4b2bb1463523c5f0ce84155aebb43aabf6611d23a3513c4804","observation_id":"e4aa5648-db3b-4be7-ade6-9fd1c50de94e","resolution":{"observed_at":"2026-08-07T04:50:00.182946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-08-07T04:50:00.186499Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.186499Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:497d1672c22b4c626f901364f09309c46de1013899e08519846fa372ada61d35","observation_id":"50533e89-9e21-42b8-844c-5106ca7e14f1","resolution":{"observed_at":"2026-08-07T04:50:00.186499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.940153Z","title":null,"venue":null,"work_id":"1d59e115-3724-4c22-9637-11d96ca6a617","year":2021},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.190116Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:42b650037de9887823d0242440be87cdedf80a5cbcb15cae8cd199b4c502cb54","observation_id":"a358ba86-58cc-4329-87c5-f8f28fee284d","resolution":{"observed_at":"2026-08-07T04:50:00.943574Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.929704Z","title":"u ndler, Mark Niklas M \\","venue":null,"work_id":"3c2ef65b-616a-404c-91ff-47b3a2083c06","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.193419Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:c347ee516c6141c7643a71a25f864123ea8d4c48a9d708fddf4ce94add3829df","observation_id":"0fde2ab8-b1f9-4dd3-afcb-8dacea8d9941","resolution":{"observed_at":"2026-08-07T04:50:00.933475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.919705Z","title":null,"venue":null,"work_id":"939bde60-3924-4db0-bdc9-ae7a09781422","year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.196714Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:d895c817cd212536031692ac29ca0659c1a5d6393f327dc78057452de924c44e","observation_id":"5b29a17e-92b7-409b-b739-9d0cd5e120c8","resolution":{"observed_at":"2026-08-07T04:50:00.923174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.908770Z","title":"do anything now","venue":null,"work_id":"0f6a2279-8f5d-4dd8-8212-c00af7c71082","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.199724Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:bf33619706c9b272de0d24e6d1141468c68a7ccc708c38be31e4c0cf541828ec","observation_id":"e7683656-a1bd-4537-aaef-7b477760998e","resolution":{"observed_at":"2026-08-07T04:50:00.912398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.202923Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.202923Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:77085d96644f5c50b665a1a3b3703a7facc626e77edbc68dff796e5b3e1d7ced","observation_id":"36f055a0-5e8a-40fb-9d6b-71cf64ba9975","resolution":{"observed_at":"2026-08-07T04:50:00.202923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01343","last_updated":"2024-07-17T07:26:47Z","snapshot_observed_at":"2026-07-06T17:54:07.815827Z","submitted_at":"2024-03-31T07:11:48Z","title":"CHOPS: CHat with custOmer Profile Systems for Customer Service with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01343","snapshot_observed_at":"2026-08-07T04:50:00.206194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.206194Z"},"links":{"cited_paper":"/paper/2404.01343","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:bdba0a2e2b116b6da8c47a41ebf2024c7f9ba1fca3ec7c1fa3bce90f003b95bb","observation_id":"f46532e3-00d6-4dd6-99fb-2a643e881f52","resolution":{"observed_at":"2026-08-07T04:50:00.206194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-03T06:05:20.058180Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-07T04:50:00.209867Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.209867Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:b5db811acc824ecf5c6d88c21648d2ed83313287eefeb5c6e74b2b3bc9857cf5","observation_id":"ada563b1-aadb-4908-9872-59d56c02826d","resolution":{"observed_at":"2026-08-07T04:50:00.209867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.214612Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.214612Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:26e2ee76e23272d17483cf488396d081d179e9222f6e71ceb63a114beb85c843","observation_id":"04ecd511-17b3-4848-8819-74ac326f158f","resolution":{"observed_at":"2026-08-07T04:50:00.214612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04686","last_updated":"2024-08-08T09:18:47Z","snapshot_observed_at":"2026-07-06T18:58:35.218405Z","submitted_at":"2024-08-08T09:18:47Z","title":"Multi-Turn Context Jailbreak Attack on Large Language Models From First Principles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04686","snapshot_observed_at":"2026-08-07T04:50:00.218144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.218144Z"},"links":{"cited_paper":"/paper/2408.04686","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:5109d7f6a7ae67bad1be297b3b0d7a165592b67b5c259e0925e40a125f5461a4","observation_id":"c7f4545a-55a6-4feb-8926-256a2478f566","resolution":{"observed_at":"2026-08-07T04:50:00.218144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.891533Z","title":null,"venue":null,"work_id":"3679e6fb-227a-4452-8ab9-6bd99f5697a5","year":2002},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.221806Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:9ce8a4cf4d57a3511ee8857f6d3d2863b406d488666f349fa7826f6b436ef5e7","observation_id":"0066ba6d-3785-41fd-96c2-443202205f55","resolution":{"observed_at":"2026-08-07T04:50:00.895130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03550","last_updated":"2024-03-06T08:50:25Z","snapshot_observed_at":"2026-07-06T17:40:20.922598Z","submitted_at":"2024-03-06T08:50:25Z","title":"Emotional Manipulation Through Prompt Engineering Amplifies Disinformation Generation in AI Large Language Models","version":1},"cited_work":{"arxiv_id":"2403.03550","doi":"10.48550/arxiv.2403.03550","metadata_source":"pith","pith_arxiv_id":"2403.03550","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Emotional Manipulation Through Prompt Engineering Amplifies Disinformation Generation in AI Large Language Models","venue":"cs.AI","work_id":"8dfe4870-ce7d-4d79-be0a-fd6218430ea8","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.225273Z"},"links":{"cited_paper":"/paper/2403.03550","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:465689745406585ce58798e18523d4573a71cdde2bdc357eb480a72dba0c4414","observation_id":"0c447225-0981-48ad-aafa-07b43f553d88","resolution":{"observed_at":"2026-08-07T04:50:00.289354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03017","last_updated":"2025-01-26T01:52:22Z","snapshot_observed_at":"2026-07-06T19:27:25.061335Z","submitted_at":"2024-10-03T21:58:39Z","title":"Tutor CoPilot: A Human-AI Approach for Scaling Real-Time Expertise","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03017","snapshot_observed_at":"2026-08-07T04:50:00.228964Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.228964Z"},"links":{"cited_paper":"/paper/2410.03017","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:89e528dc2dd9e4c6fe1f54228487c0f257fec602610ee3dd3549c5a1f581cbbe","observation_id":"617a1164-8ca5-4f15-bafa-2f5dfbfabcb7","resolution":{"observed_at":"2026-08-07T04:50:00.228964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T04:50:00.232482Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.232482Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:397b476f0c2c2595b4b471e9bfa8119049ffd7bbe9017b2b197eaacc23e9de7e","observation_id":"5f6b1128-03a9-4a3a-885e-aefa408de241","resolution":{"observed_at":"2026-08-07T04:50:00.232482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-07T04:50:00.235971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.235971Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:043444d50972125c4a95e2cee2e08111bade26c2dd1a54438877a83dfd24700c","observation_id":"f2aa3b30-54c0-4f1e-8b3f-35ebd1d96784","resolution":{"observed_at":"2026-08-07T04:50:00.235971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.239482Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.239482Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:4929b35f8d7953cd1291f572d37e5b1e768be377bb0e74d68d37457497b7e0e3","observation_id":"bdddd043-26b7-436e-9c0a-a2d6f4633c16","resolution":{"observed_at":"2026-08-07T04:50:00.239482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16416","last_updated":"2026-04-23T17:36:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-20T17:59:23Z","title":"Survey on Evaluation of LLM-based Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16416","snapshot_observed_at":"2026-08-07T04:50:00.243042Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.243042Z"},"links":{"cited_paper":"/paper/2503.16416","citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:34eac36d711d6d2d9bbdf6292fbb242c851f712f534ce760bcc0c6e7302c67e6","observation_id":"a67f23d5-4b4a-419f-8f27-be2a1c2ced3d","resolution":{"observed_at":"2026-08-07T04:50:00.243042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.873889Z","title":null,"venue":null,"work_id":"36f151e3-a5d3-4615-bd3d-d0f232b271a2","year":2024},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.246609Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:dd2b8a7b21a40f52f2903bea69419d856965c90b3ff59ffcf07c4c48b8bb18a4","observation_id":"816d0e1b-59bd-4e90-9fb5-a609d7754cc9","resolution":{"observed_at":"2026-08-07T04:50:00.877545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.249996Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.249996Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:1dfa6cbcd2c3f14cddcfe362529354ea0181782e529271fff208d96bce47f256","observation_id":"80feea2e-0a2a-4cb2-a8a6-236e3e9bf407","resolution":{"observed_at":"2026-08-07T04:50:00.249996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:50:00.253920Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:50:00.253920Z"},"links":{"citing_paper":"/paper/2506.09600"},"observation_digest":"sha256:32d787efebc074092081b6f2012b4fb9814c6971742cdffba659d06acfcb1dfd","observation_id":"82e72879-d510-4f14-9dad-a2a6be99f225","resolution":{"observed_at":"2026-08-07T04:50:00.253920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09600","last_updated":"2025-08-23T09:21:30Z","latest_version":3,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T06:27:40.436487Z","submitted_at":"2025-06-11T10:59:47Z","title":"Effective Red-Teaming of Policy-Adherent Agents"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2506.09600."}