{"as_of":"2026-08-07T07:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04b8d61425744fb27b72e6c1d9c48c38df34d75fe4cc445c6c13361b5f356ec4","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:29:58.290673Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03166/citation-record","integrity":"/paper/2608.03166/integrity","json":"/paper/2608.03166/citation-record.json","paper":"/paper/2608.03166"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.11484","last_updated":"2025-01-10T02:18:01Z","snapshot_observed_at":"2026-07-06T18:47:00.524107Z","submitted_at":"2024-07-16T08:20:39Z","title":"The Oscars of AI Theater: A Survey on Role-Playing with Language Models","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11484","snapshot_observed_at":"2026-08-06T00:29:55.891371Z","title":"The Oscars of AI Theater: A Survey on Role- Playing with Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:55.891371Z"},"links":{"cited_paper":"/paper/2407.11484","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:477d0bd5af6e5ce66d6092fb8720435ed47db463dc8d911d605031ec3574f759","observation_id":"b9fac2ea-4937-4cc2-8d6d-b81eafb9675c","resolution":{"observed_at":"2026-08-06T00:29:55.891371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09624","last_updated":"2023-11-11T05:30:34Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T17:10:28Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09624","snapshot_observed_at":"2026-08-06T00:29:55.943379Z","title":"ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:55.943379Z"},"links":{"cited_paper":"/paper/2310.09624","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:25b52345e8286ced5490332dd02c26b857e1b110db8843d81aeb373101cb8c30","observation_id":"00c93cdc-df59-47ba-bbb0-569dfd3da8a1","resolution":{"observed_at":"2026-08-06T00:29:55.943379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T00:29:56.028755Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.028755Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:c9596bbf09dc425d37f45eaaa14583bdd78362048818531ee19413991078963d","observation_id":"103f45a2-66bb-4496-98f7-7f48abc91fd2","resolution":{"observed_at":"2026-08-06T00:29:56.028755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.331000Z","title":"RoleMRC: A Fine-Grained Composite Benchmark for Role-Playing Language Agents,","venue":null,"work_id":"8ef94c39-2d3b-4394-ac7b-44f099f96449","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.129225Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:ce5269516e721c1c4221acf0fbfdbe6511fe6f2e6737148c217de42311028387","observation_id":"59846c01-4ae4-47c3-9ac5-60a8dff937ac","resolution":{"observed_at":"2026-08-06T00:30:00.431231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08592","last_updated":"2023-11-29T23:18:16Z","snapshot_observed_at":"2026-07-06T16:47:41.767386Z","submitted_at":"2023-11-14T23:28:23Z","title":"AART: AI-Assisted Red-Teaming with Diverse Data Generation for New LLM-powered Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08592","snapshot_observed_at":"2026-08-06T00:29:56.208408Z","title":"AART: AI-Assisted Red-Teaming with Diverse Data Generation for New LLM-powered Applications,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.208408Z"},"links":{"cited_paper":"/paper/2311.08592","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f1e4aae664486632edf42b2556da562a3c6d9d0a2363443a7d8e32afd2174114","observation_id":"153fcb74-d969-4170-8d67-9e08ce1803b1","resolution":{"observed_at":"2026-08-06T00:29:56.208408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13195","last_updated":"2025-05-19T14:50:44Z","snapshot_observed_at":"2026-08-07T01:33:08.551457Z","submitted_at":"2025-05-19T14:50:44Z","title":"Adversarial Testing in LLMs: Insights into Decision-Making Vulnerabilities","version":1},"cited_work":{"arxiv_id":"2505.13195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13195","snapshot_observed_at":"2026-08-06T00:29:59.765276Z","title":"Adversarial Testing in LLMs: Insights into Decision-Making Vulnerabilities","venue":"cs.AI","work_id":"55f2c3b2-201e-47dd-8c9f-446aeb134540","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.341529Z"},"links":{"cited_paper":"/paper/2505.13195","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:14b543d44ed29499acf6c3537af9132a124fdb61339ed63e5612ebe70f188431","observation_id":"8416447f-0537-483c-91d7-93dbd9f4b2fc","resolution":{"observed_at":"2026-08-06T00:29:59.822893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.191532Z","title":"Red Teaming Large Language Models: A Comprehensive Review and Critical Analysis,","venue":null,"work_id":"d29f138b-3ed3-404d-9561-b9817e65800f","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.408327Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:fdcc671f669bd13358ce7157b9f735b6ab3fcb4c9467c56ad997a1b0f06cffb1","observation_id":"4dded492-67ed-4285-83f1-5d72175ab62e","resolution":{"observed_at":"2026-08-06T00:30:00.272974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:30:00.036601Z","title":"Security of LLM-based Agents: Attacks, Defenses, and Applications,","venue":null,"work_id":"e2059deb-00b4-4cc7-9a17-ebee86ad450f","year":2026},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.485119Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:44c42107ddcb3fe5615f059e6546520846e95e04cbdcbaf9f3e82409de68cfee","observation_id":"aa86cdb8-632d-499e-98c9-a29c2ba83f91","resolution":{"observed_at":"2026-08-06T00:30:00.131587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18036","last_updated":"2025-06-22T13:34:58Z","snapshot_observed_at":"2026-08-06T23:21:05.965223Z","submitted_at":"2025-06-22T13:34:58Z","title":"Markov-Enhanced Clustering for Long Document Summarization: Tackling the 'Lost in the Middle' Challenge with Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.18036","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.18036","snapshot_observed_at":"2026-08-06T00:29:59.921236Z","title":"Markov-Enhanced Clustering for Long Document Summarization: Tackling the 'Lost in the Middle' Challenge with Large Language Models","venue":"cs.CL","work_id":"f03130d7-fd1b-4730-b8d7-7ee44e52bde9","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.532477Z"},"links":{"cited_paper":"/paper/2506.18036","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f761e1d906e7190e68189ba8bd95285f384233cecbed2d60df4f8bef347403bb","observation_id":"4dc2bad5-597b-4a54-b856-a8b2916e6f24","resolution":{"observed_at":"2026-08-06T00:29:59.970446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-06T17:01:00.147032Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-06T00:29:56.632621Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.632621Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:eaeb6cca7126825177487d7c35e4bfae9ffaa4d78e1d5ef1f8f295007bd1d1cc","observation_id":"51ee87da-f0b5-42b3-9169-f8cfd2021453","resolution":{"observed_at":"2026-08-06T00:29:56.632621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11083","last_updated":"2026-05-30T02:54:00Z","snapshot_observed_at":"2026-08-06T15:11:46.271382Z","submitted_at":"2025-06-04T09:09:54Z","title":"RedDebate: Safer Responses Through Multi-Agent Red Teaming Debates","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11083","snapshot_observed_at":"2026-08-06T00:29:56.700795Z","title":"RedDebate: Safer Responses through Multi-Agent Red Teaming Debates,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.700795Z"},"links":{"cited_paper":"/paper/2506.11083","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:cc045bf60f8c04d10b3b6b4fd35e52d2e58e3918e1b22ef9c36bbcee0033971a","observation_id":"593966c0-7a4e-4ad2-93af-ea9b594737a8","resolution":{"observed_at":"2026-08-06T00:29:56.700795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07689","last_updated":"2023-11-13T19:13:29Z","snapshot_observed_at":"2026-07-06T16:47:01.374736Z","submitted_at":"2023-11-13T19:13:29Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07689","snapshot_observed_at":"2026-08-06T00:29:56.778717Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.778717Z"},"links":{"cited_paper":"/paper/2311.07689","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:9f97b5d5421b2820c4ece1aa586aae65163d4660f4d5d3b653d86d7ae36f6e72","observation_id":"edb960e9-8d02-478f-ab19-7cf4cadd7b88","resolution":{"observed_at":"2026-08-06T00:29:56.778717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11855","last_updated":"2024-02-02T08:28:01Z","snapshot_observed_at":"2026-08-07T01:32:12.754339Z","submitted_at":"2023-11-20T15:50:09Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11855","snapshot_observed_at":"2026-08-06T00:29:56.858992Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.858992Z"},"links":{"cited_paper":"/paper/2311.11855","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:64c39f9dab659a7dd5d6a3067c6acc214fe5ded1ea9c9305c25cbf94b21f57f2","observation_id":"fcd9b88f-f8d7-48cb-8a23-07b0bcc1fd3d","resolution":{"observed_at":"2026-08-06T00:29:56.858992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16667","last_updated":"2024-07-23T17:34:36Z","snapshot_observed_at":"2026-07-06T18:50:48.181248Z","submitted_at":"2024-07-23T17:34:36Z","title":"RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16667","snapshot_observed_at":"2026-08-06T00:29:56.930215Z","title":"RedA- gent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.930215Z"},"links":{"cited_paper":"/paper/2407.16667","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:a95f2cebd5b480d0da33ee8e71107ccaa93e4c73abf068194b6494a601106c2e","observation_id":"2a562869-30fa-40f6-a310-093383e3a0f5","resolution":{"observed_at":"2026-08-06T00:29:56.930215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01304","last_updated":"2025-03-03T08:42:13Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T08:42:13Z","title":"Encounter-based model of a run-and-tumble particle with stochastic resetting","version":1},"cited_work":{"arxiv_id":"2503.01304","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01304","snapshot_observed_at":"2026-08-06T00:29:59.527938Z","title":"Encounter-based model of a run-and-tumble particle with stochastic resetting","venue":"cond-mat.stat-mech","work_id":"89c49c36-8672-442f-b557-8b4ed3716167","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:56.998828Z"},"links":{"cited_paper":"/paper/2503.01304","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:28176113375fce6bf5211117b8c2540ec74ece010f08eea3b77ea1f7561c7fc8","observation_id":"d28070b9-00f4-4e73-b1d8-8654f92726e6","resolution":{"observed_at":"2026-08-06T00:29:59.614995Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:29:57.065596Z","title":"Exposing Weak Links in Multi-Agent Systems under Adver- sarial Prompting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.065596Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:cb62c99a4fc8704f235f658cc370381b5d6eea3c31be721a17dc556cdb5bf032","observation_id":"be359958-702e-4cb7-a28d-851c99af979f","resolution":{"observed_at":"2026-08-06T00:29:57.065596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17458","last_updated":"2024-10-22T22:27:33Z","snapshot_observed_at":"2026-07-06T19:38:09.286994Z","submitted_at":"2024-10-22T22:27:33Z","title":"Iwasawa module of the cyclotomic $\\mathbb{Z}_{2}$-extension of certain real quadratic fields","version":1},"cited_work":{"arxiv_id":"2410.17458","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17458","snapshot_observed_at":"2026-08-06T00:29:59.224087Z","title":"Iwasawa module of the cyclotomic $\\mathbb{Z}_{2}$-extension of certain real quadratic fields","venue":"math.NT","work_id":"32a325c2-9cf6-45c4-9a5c-76e747103f04","year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.300906Z"},"links":{"cited_paper":"/paper/2410.17458","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f859960e127cad75b8d43ed6f6c9c511eaee7aa2ac313b5329a6d5003e598e83","observation_id":"6913ec36-c166-4117-bbd4-745fc6aace07","resolution":{"observed_at":"2026-08-06T00:29:59.270567Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05692","last_updated":"2025-06-20T12:42:57Z","snapshot_observed_at":"2026-07-06T21:37:42.063760Z","submitted_at":"2025-06-06T02:48:02Z","title":"SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05692","snapshot_observed_at":"2026-08-06T00:29:57.375647Z","title":"SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.375647Z"},"links":{"cited_paper":"/paper/2506.05692","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:b307e848c2e8612a895fb0aa81f930710bf1380bec87fe247d7c2b25313e1e6a","observation_id":"c6ca3504-9d98-4ad8-8114-0bcf1183b914","resolution":{"observed_at":"2026-08-06T00:29:57.375647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:29:57.468919Z","title":"From Prompt Injections to Protocol Exploits: Threats in LLM-Powered AI Agent Workflows,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.468919Z"},"links":{"citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f10c60c67f6c81cc23f1b6b01f4838e24f01be0321c94a1bc7202e1ad2e99034","observation_id":"a3dc3093-1dfc-4dff-8728-9dbef0276e2e","resolution":{"observed_at":"2026-08-06T00:29:57.468919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12345","last_updated":"2023-11-21T04:38:21Z","snapshot_observed_at":"2026-07-06T16:50:22.657866Z","submitted_at":"2023-11-21T04:38:21Z","title":"Stable Diffusion For Aerial Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12345","snapshot_observed_at":"2026-08-06T00:29:57.573900Z","title":"AvalonBench: Evaluating LLMs Playing the Game of Avalon,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.573900Z"},"links":{"cited_paper":"/paper/2311.12345","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:b03f35cd00b9b3db87220be864c204a39002074697990a70d6bc2e3959f32723","observation_id":"891d8d25-88bf-48f7-bdc6-ff1dad7283dc","resolution":{"observed_at":"2026-08-06T00:29:57.573900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01987","last_updated":"2025-02-04T04:02:58Z","snapshot_observed_at":"2026-07-06T20:30:40.963009Z","submitted_at":"2025-02-04T04:02:58Z","title":"Online Adaptive Traversability Estimation through Interaction for Unstructured, Densely Vegetated Environments","version":1},"cited_work":{"arxiv_id":"2502.01987","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.01987","snapshot_observed_at":"2026-08-06T00:29:58.983569Z","title":"Online Adaptive Traversability Estimation through Interaction for Unstructured, Densely Vegetated Environments","venue":"cs.RO","work_id":"3bfc1b21-5d31-4bd5-bf0a-b333c42e0ed5","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.693775Z"},"links":{"cited_paper":"/paper/2502.01987","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:d6e5670b682be009b07b0c20875c3154d0054c1876c472f4c2c744197a0259f8","observation_id":"dc053066-a483-4ae5-860e-62584c6b65a2","resolution":{"observed_at":"2026-08-06T00:29:59.083036Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13137","last_updated":"2025-05-19T14:07:36Z","snapshot_observed_at":"2026-07-06T21:26:15.934710Z","submitted_at":"2025-05-19T14:07:36Z","title":"Learning to Adapt to Position Bias in Vision Transformer Classifiers","version":1},"cited_work":{"arxiv_id":"2505.13137","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13137","snapshot_observed_at":"2026-08-06T00:29:58.860214Z","title":"Learning to Adapt to Position Bias in Vision Transformer Classifiers","venue":"cs.CV","work_id":"d9e7ccbf-e63f-4cbc-9663-7e5e9048cda0","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.773801Z"},"links":{"cited_paper":"/paper/2505.13137","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:1b26caf9508e86a1e55cd7ff310d5935fb43fc48b5c2eac11d2148ab7f70c5ae","observation_id":"3974ba24-355a-435e-8cb6-3c8a78a87e94","resolution":{"observed_at":"2026-08-06T00:29:58.912857Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11241","last_updated":"2025-03-14T09:46:05Z","snapshot_observed_at":"2026-08-06T09:59:02.941118Z","submitted_at":"2025-03-14T09:46:05Z","title":"Compound Expression Recognition via Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":"2503.11241","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.11241","snapshot_observed_at":"2026-08-06T00:29:58.736431Z","title":"Compound Expression Recognition via Large Vision-Language Models","venue":"cs.CV","work_id":"06e93c63-b384-4012-87ff-1161d246b37d","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.020373Z"},"links":{"cited_paper":"/paper/2503.11241","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:dc8bb62e8163a748a1453a8029a4ce763c086da630318ad12b87fb7bedeb2c9a","observation_id":"ca0e29d1-e053-4708-b07e-129e648b92ac","resolution":{"observed_at":"2026-08-06T00:29:58.788800Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12589","last_updated":"2025-03-16T17:49:07Z","snapshot_observed_at":"2026-07-06T20:53:31.919637Z","submitted_at":"2025-03-16T17:49:07Z","title":"Context-Aware Two-Step Training Scheme for Domain Invariant Speech Separation","version":1},"cited_work":{"arxiv_id":"2503.12589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.12589","snapshot_observed_at":"2026-08-06T00:29:58.519869Z","title":"Context-Aware Two-Step Training Scheme for Domain Invariant Speech Separation","venue":"cs.SD","work_id":"dd836cb3-2bc0-46ce-9639-7418bac7a293","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.108401Z"},"links":{"cited_paper":"/paper/2503.12589","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:680aeb4444059fc1659ed339bdcb39e92f8eabfca344e2f400f5e437b0eb18f1","observation_id":"b455f210-342a-402c-a79c-e6bb5e790e4b","resolution":{"observed_at":"2026-08-06T00:29:58.622840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00787","last_updated":"2024-09-01T17:40:04Z","snapshot_observed_at":"2026-07-06T19:08:57.415038Z","submitted_at":"2024-09-01T17:40:04Z","title":"The Dark Side of Human Feedback: Poisoning Large Language Models via User Inputs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00787","snapshot_observed_at":"2026-08-06T00:29:58.203660Z","title":"CoP: Agentic Red-teaming for Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.203660Z"},"links":{"cited_paper":"/paper/2409.00787","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:5e7357418f414076cac4db68d5827bc160cf0ffea2067b6bec744f402f54e755","observation_id":"5a58fb64-3080-4b1b-b706-afef034d9e26","resolution":{"observed_at":"2026-08-06T00:29:58.203660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09865","last_updated":"2025-01-16T22:29:12Z","snapshot_observed_at":"2026-08-03T13:08:30.296039Z","submitted_at":"2025-01-16T22:29:12Z","title":"Lower bounds on the $\\ell$-rank of ideal class groups","version":1},"cited_work":{"arxiv_id":"2501.09865","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.09865","snapshot_observed_at":"2026-08-06T00:29:58.382649Z","title":"Lower bounds on the $\\ell$-rank of ideal class groups","venue":"math.NT","work_id":"ea3dcc0f-48c6-4ae5-b5cd-229afe81f5a8","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:58.290673Z"},"links":{"cited_paper":"/paper/2501.09865","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:566a414e4c56535589521740aa8af940c4d2f34adb46916583047102112edafd","observation_id":"d7788856-23e0-4090-9d8f-4f6cd1ed82a9","resolution":{"observed_at":"2026-08-06T00:29:58.420619Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01942","last_updated":"2024-08-29T05:48:42Z","snapshot_observed_at":"2026-07-06T17:39:07.926765Z","submitted_at":"2024-03-04T11:24:51Z","title":"Mitigating Label Noise on Graph via Topological Sample Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01942","snapshot_observed_at":"2026-08-06T00:29:57.946969Z","title":"Available: https://arxiv.org/abs/2403.01942","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.946969Z"},"links":{"cited_paper":"/paper/2403.01942","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:f0e5948903b57b1f275ad238b6a5047080222a3a8fe1968187f551e95bbdca06","observation_id":"58b5660d-6260-46e1-908c-065a195af10c","resolution":{"observed_at":"2026-08-06T00:29:57.946969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17458","last_updated":"2026-04-20T03:53:49Z","snapshot_observed_at":"2026-07-06T22:17:26.368596Z","submitted_at":"2025-08-24T17:26:58Z","title":"Evaluating the Impact of Verbal Multiword Expressions on Machine Translation","version":2},"cited_work":{"arxiv_id":"2508.17458","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.17458","snapshot_observed_at":"2026-08-06T00:29:59.343799Z","title":"Evaluating the Impact of Verbal Multiword Expressions on Machine Translation","venue":"cs.CL","work_id":"5bd557c6-303d-4f54-a51f-163c52c6ab99","year":2025},"citing_paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:29:57.241797Z"},"links":{"cited_paper":"/paper/2508.17458","citing_paper":"/paper/2608.03166"},"observation_digest":"sha256:45f4742cda8e2ab1974d8eb92e4cc814b783c0debe816d79ce71750f6a24d260","observation_id":"d839405d-1902-4356-b701-0d250ea816f7","resolution":{"observed_at":"2026-08-06T00:29:59.419281Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03166","last_updated":"2026-08-04T05:54:32Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T07:24:29.881087Z","submitted_at":"2026-08-04T05:54:32Z","title":"Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":3},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2608.03166."}