{"as_of":"2026-08-04T09:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:62973686d63a6a4576dc4ae20c74992f4b85d8178d935de6592379907dc17dc3","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T20:55:21.031591Z","state":"measured"},{"denominator":79,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":79,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.06807/citation-record","integrity":"/paper/2607.06807/integrity","json":"/paper/2607.06807/citation-record.json","paper":"/paper/2607.06807"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6ee6214ebc89f5f2371b88798dbdb544b0d3d9692564ad2c7959e2af0053fb56","observation_id":"96788680-c4c1-4db7-8808-e02a60b70f6c","resolution":{"observed_at":"2026-07-10T20:57:34.995323Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-07-10T20:57:35.014119Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:743feacd9c381d476cd85c88d38659500fb09220158c7d50ebd0ca9fd5be30bc","observation_id":"ac7258ce-13a5-4b1f-afb2-b9be6f1ba4c1","resolution":{"observed_at":"2026-07-10T20:57:35.029686Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:15.620681+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:b9c06811f0fb6cf75d9411cb5092af17cbd3f8822670ad720cb1c799f1b2cf40","observation_id":"b276e316-fdb6-4c6d-98ae-cc019be49b72","resolution":{"observed_at":"2026-07-10T20:57:34.828909Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.946557Z","title":"Frontiers of Computer Science , volume=","venue":null,"work_id":"2f3cc25b-7c92-44cd-b5f3-cb7712fc7b22","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:d174292083f0e9d7def7dcbbbeb3c3d90eed1a171706216f1b5eb1bb5d1f2634","observation_id":"ff2b41a1-8d09-4d1d-b67a-523acb272037","resolution":{"observed_at":"2026-07-10T20:57:35.968241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.896389Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"d0a9eb97-b28b-45a3-9985-851d90319035","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:78f111cea3b470c1a834bb4aad661874d59cdeaf646dd9d8c05a168c14ced013","observation_id":"d3be19a4-7216-4ba6-a281-2919442ef2e2","resolution":{"observed_at":"2026-07-10T20:57:35.914835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.917138Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"4a8bfb2f-6555-4986-99cd-393a2d8e02d6","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:7c4125ca5a7720a28a9b11a14634620122a439d393028b7ee51e1b41163492e6","observation_id":"87a92a94-adc6-4ae9-a189-0a8493770a5c","resolution":{"observed_at":"2026-07-10T20:57:35.937825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.513820Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":"8616d356-a99c-41f6-ab2f-06d2a9af570d","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:2e0877db06429a5b40fe6e32fb99c9d8d0bd0930feb61bc202ce916fad6dee87","observation_id":"cbc9cc4c-73a1-4fc3-8b88-e49e4362b092","resolution":{"observed_at":"2026-07-10T20:57:35.537088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07155","last_updated":"2025-03-17T00:22:42Z","snapshot_observed_at":"2026-07-06T18:28:47.000729Z","submitted_at":"2024-06-11T11:02:04Z","title":"Scaling Large Language Model-based Multi-Agent Collaboration","version":3},"cited_work":{"arxiv_id":"2406.07155","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.07155","snapshot_observed_at":"2026-07-10T20:57:34.565736Z","title":"Yu Shang et al","venue":"cs.AI","work_id":"8c6b62a4-4ade-4a58-958c-9035f4524b6e","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.07155","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:34305d7821b260e350e08c5896cf16a270501b626b086f64c315f1254c08d069","observation_id":"6bfcbace-c70b-442f-a65c-aed5ad95e5ba","resolution":{"observed_at":"2026-07-10T20:57:34.580097Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.632870Z","title":"author=","venue":null,"work_id":"0930a90d-19f0-41ba-9668-f983a65aa8e6","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c454a7f919c695bf11c5973e8264f9998b0944e5f76d46d323f27f0246304f99","observation_id":"4b0e31d7-37d7-4263-b851-d33160c57eae","resolution":{"observed_at":"2026-07-10T20:57:35.652640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.204686Z","title":"Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining V","venue":null,"work_id":"cb50c559-955e-4be0-8dfe-cc8abd3d636e","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6318fdcf03bb1f6ede5f7aca2f622c56e47bff6149a762b0e923d391fdb20a47","observation_id":"2957c9cd-ab30-4d67-85c2-1c1fcf7162b1","resolution":{"observed_at":"2026-07-10T20:57:36.220087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.214170Z","title":"2025 IEEE Conference on Secure and Trustworthy Machine Learning (SaTML) , pages=","venue":null,"work_id":"0b9b8e81-3121-42b2-99f6-d5390c7e30dc","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:fc040510981774062bcc19bc2db32d22a2220bc85cc869ac8486024ea4a1bc7d","observation_id":"b985f25c-b7c3-46ca-9007-06eadf48fdb2","resolution":{"observed_at":"2026-07-10T20:57:36.229297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-07-06T16:43:38.787699Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":"2311.03191","doi":"10.48550/arxiv.2311.03191","metadata_source":"pith","pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-07-10T20:57:34.605716Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","venue":"cs.LG","work_id":"5ab14a22-d25d-4d5f-8b1e-f2ff79daf69d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8bd6ca106dbd6c94ca7095fda4ad0d98a2ee4a630cd1e1c1521949c7e82766d0","observation_id":"fbf3cfad-54c3-4069-871a-63b61fc40a6a","resolution":{"observed_at":"2026-07-10T20:57:34.622539Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.949745Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"876747a1-add1-4112-b7ee-eab2b90f878b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:354b9c678e74acd49f50109bf1078ac0a8c99b992287bb8d15e53b4b6c2471f1","observation_id":"5ab3aae1-2637-44a4-9263-91c0d68b1018","resolution":{"observed_at":"2026-07-10T20:57:35.969333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18948","last_updated":"2025-08-29T06:03:42Z","snapshot_observed_at":"2026-07-06T19:58:22.387205Z","submitted_at":"2024-11-28T06:29:46Z","title":"RevPRAG: Revealing Poisoning Attacks in Retrieval-Augmented Generation through LLM Activation Analysis","version":5},"cited_work":{"arxiv_id":"2411.18948","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.18948","snapshot_observed_at":"2026-07-10T20:57:34.959834Z","title":"11 Florian Tramèr, Nicholas Carlini, Wieland Brendel, Aleksander Madry, Alexey Kurakin, and Nico- las Papernot","venue":"cs.CR","work_id":"3a5be880-4072-42a5-9135-b55e2a0e6826","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2411.18948","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c855ce504bbf879a0bc4ab35ab9c90b8e5de7373cd84552f23851720f5845673","observation_id":"a6478b69-8110-4f00-9e8e-b95600c45bc3","resolution":{"observed_at":"2026-07-10T20:57:34.974946Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.973848Z","title":"Findings of the Association for Computational Linguistics ACL 2024 , pages=","venue":null,"work_id":"5b986cb8-0194-449e-9611-900d9c31f267","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:76f61edcc1037565a2af54a5e39156c638f4764fcb60ff404d7fc853fb8284b2","observation_id":"e57bf030-f21d-445d-82d9-05dc65abec5c","resolution":{"observed_at":"2026-07-10T20:57:36.000678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.878672Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"fa4bad01-f3c7-4c7e-91f0-3fd9ac642bc8","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:993de09776dfb434332c00ad0c0e2bc8b090f535b76c036aee27d022a6ef9e0f","observation_id":"a19b7883-5357-4b5f-a4de-341be8b0f687","resolution":{"observed_at":"2026-07-10T20:57:35.895527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00799","last_updated":"2025-03-06T17:43:10Z","snapshot_observed_at":"2026-08-03T23:30:33.347508Z","submitted_at":"2024-06-02T16:53:21Z","title":"Get my drift? Catching LLM Task Drift with Activation Deltas","version":6},"cited_work":{"arxiv_id":"2406.00799","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.00799","snapshot_observed_at":"2026-07-10T20:57:34.835399Z","title":"Are you still on track!? catching LLM task drift with activations","venue":"cs.CR","work_id":"f913aa64-dddb-4ce5-9f2c-5e314589aa1a","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.00799","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:baf1c24f1f1e8c05080bc165d565ba2441821ba4976349af50cea8040f5ce9d3","observation_id":"4378fb33-7fba-4141-8afe-b42e1254040a","resolution":{"observed_at":"2026-07-10T20:57:34.851213Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.897824Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"f6849288-6909-4838-8583-44e46a1f962b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:205e37dafca09b199cd4a080cb4e0295f0308a369e776a37271113d4d0479b16","observation_id":"84cdd8e4-2e1a-4b30-8360-17e31f7ae762","resolution":{"observed_at":"2026-07-10T20:57:35.919538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07557","last_updated":"2025-02-11T13:50:50Z","snapshot_observed_at":"2026-07-06T20:34:44.083385Z","submitted_at":"2025-02-11T13:50:50Z","title":"JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation","version":1},"cited_work":{"arxiv_id":"2502.07557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.07557","snapshot_observed_at":"2026-07-10T20:57:34.899802Z","title":"Jbshield: Defending large language models from jailbreak attacks through activated concept anal- ysis and manipulation.arXiv preprint arXiv:2502.07557","venue":"cs.CR","work_id":"1a9c517d-7eb4-4ab2-baf5-aa7c21bfefac","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.07557","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:599a13db9264fad69f63a7a15572153cc05904865711be14c93688ed8d0b607b","observation_id":"e6e9c041-3718-4108-b816-5722b6a777f5","resolution":{"observed_at":"2026-07-10T20:57:34.916124Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.922952Z","title":null,"venue":null,"work_id":"39bef275-0cda-45d0-9e19-0da4a496e32f","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:016f4c9749c00a7f280dbe354b72f8c759afbbc7461ced2e2ab0d4285ef79e1a","observation_id":"d3520720-f9ab-4df1-9c89-01ffc474de57","resolution":{"observed_at":"2026-07-10T20:57:35.945343Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e7435ce71577b609fbebf7ded82ab276e60e0cb26c3d3e90df22a02b384bf908","observation_id":"fe3a04f6-c054-4b93-a85e-4153e2764802","resolution":{"observed_at":"2026-07-10T20:57:34.602027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.07675","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:34.920017Z","title":"DynTaskMAS : A dynamic task graph-driven framework for asynchronous and parallel LLM -based multi-agent systems","venue":null,"work_id":"46ab1588-2309-463c-a23f-2b981d37349d","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e9108d5d7e104b9d2ebaaca0fd1cf280b9ea070f359c87671421761044ca97f2","observation_id":"46fca5ae-73f9-4b92-aa0a-047196f9be9c","resolution":{"observed_at":"2026-07-10T20:57:34.936792Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.706094Z","title":"Proceedings of the 2018 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"b8274e43-cc96-4d74-9434-90fc49873206","year":2018},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:0f237f380e845d82b60011a702e0f29e3e93af67a8b3e719a6b7d000732fe8bd","observation_id":"a8d4ac11-f435-43a4-9d19-38ded621310a","resolution":{"observed_at":"2026-07-10T20:57:35.723234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.459358Z","title":"2024 , howpublished=","venue":null,"work_id":"6134694d-3871-4383-81fc-600ef8f73761","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5fa4031d6989da15cdaba22a604ab4e078a0b560fbb9b80e9b1c4beac746b602","observation_id":"8bda52b4-e1b4-4c1a-97ea-5d1310db6adc","resolution":{"observed_at":"2026-07-10T20:57:35.482312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.165083Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"6cfd3349-bd29-48cd-b95c-cada462b7211","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:4dff359e20e3d344c7dc045796aba8a6378917f886e34df4f594728340cce8e1","observation_id":"5f5c1104-68af-46c4-bea8-72f9b4890319","resolution":{"observed_at":"2026-07-10T20:57:36.181817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.794329Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"18debcf5-7bad-4020-b38c-024a60edea78","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:142c0077dba61e2d77df4caf871913b8a78f56715239603b3bf1c188fc5f470a","observation_id":"ccce45c3-51d7-4d18-99ba-10bb5371be01","resolution":{"observed_at":"2026-07-10T20:57:35.810777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04445","last_updated":"2026-04-21T10:38:10Z","snapshot_observed_at":"2026-07-06T22:47:50.848191Z","submitted_at":"2026-02-23T21:57:27Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","version":2},"cited_work":{"arxiv_id":"2603.04445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.04445","snapshot_observed_at":"2026-07-10T20:57:34.855543Z","title":"Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey","venue":"cs.NI","work_id":"194d3c1f-5d07-497d-be5e-3c74b61f1a0f","year":2026},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2603.04445","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:18941bdb838a0f7eedc767d6c81de004123c05bcea0a1f448e6578564acda305","observation_id":"6f4e7cd1-3f79-46e1-8ab2-e935cf7c5ff1","resolution":{"observed_at":"2026-07-10T20:57:34.883304Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-07-30T15:06:18.011623Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-07-10T20:57:34.931879Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:0de2f2e9088e38b7ea8dd7fad4532152afe41dd2cf20fd25f2fba5169b82c161","observation_id":"772890eb-75f7-4074-9888-d8b4b0e57a91","resolution":{"observed_at":"2026-07-10T20:57:34.947178Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-07-10T20:57:34.659174Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c8636275ccb6f40f9ed5cca1808d20887e0691eaf0ed700b40d963e6e5fadda4","observation_id":"93aa2cbc-5f67-4cc9-a142-67b536c7c75b","resolution":{"observed_at":"2026-07-10T20:57:34.673701Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.871342+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.577399Z","title":"Machine learning , volume=","venue":null,"work_id":"3d15587f-4297-434c-b45a-cdec650baaba","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:868938127d439406986386fc72e99c1259c28e56b6be21203f04a1ee70e3b199","observation_id":"ad429d00-f485-4bdb-85ab-4adfe68a762a","resolution":{"observed_at":"2026-07-10T20:57:35.603546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.196512Z","title":"Computers & Security , volume=","venue":null,"work_id":"5a073f48-b30e-4e1b-a6c1-37a8a562770e","year":2022},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:125f3303a839aa000189ddd4f4ad1d52845259140397523b88645ed13c1f876f","observation_id":"639dbf85-d9cd-4cc5-981a-a0dd4faf9943","resolution":{"observed_at":"2026-07-10T20:57:36.211960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.486358Z","title":"European Conference on Information Retrieval , pages=","venue":null,"work_id":"2ef074f8-0ee3-476e-a0fb-9ba894637180","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:767e11f7a15297752d766f1c5cdff3cca34639ed1944f31c1fa7cbbd4e23ecb3","observation_id":"32180d9f-8008-4054-9028-bda119840acf","resolution":{"observed_at":"2026-07-10T20:57:35.518444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c9ddd6f4b6cd1576e1ac1c5bcfccc1ea35bd034846db351b333be10e9a414592","observation_id":"97a1f0f7-707b-419b-8870-b25bef562b49","resolution":{"observed_at":"2026-07-10T20:57:34.578609Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-11T03:47:48.508181Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:893d37b559849b743f4637adb5930986ecea31d2e3ccce2cfe5a20d01d0df9b0","observation_id":"eb085aae-4de5-42e9-88d6-c0a71186b60e","resolution":{"observed_at":"2026-07-10T20:57:34.716115Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:f15a2cd2746687bf7a2d5ea2e3e191261a94338b534f2180f4e1ebd4ddeb6ecd","observation_id":"5007da1d-d93f-4207-ade5-9b27fc54f98c","resolution":{"observed_at":"2026-07-10T20:57:34.732983Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.878354Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"60b3dfff-03ce-41f6-af51-f6dd6de3f1d9","year":2018},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5cfc57a5b80fbc2725fbd3fd1989e669bcefc97aeb55356556ee9b58e13568fb","observation_id":"1f0dbe6e-48ba-411c-b5aa-3e00b93800f4","resolution":{"observed_at":"2026-07-10T20:57:35.894048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.03704","doi":"10.48550/arxiv.2503.03704","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:34.603093Z","title":"Yann Dubois, Balázs Galambosi, Percy Liang, and Tat- sunori B Hashimoto","venue":null,"work_id":"cc008b41-0943-47c8-81e7-bafb5beac6ce","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8e857f4292660ec12e720c91d909b6f594d4a26bdcfaab1b5df0c9b893abffc2","observation_id":"59c9a12f-7d7b-4c49-b161-f9a441c4f900","resolution":{"observed_at":"2026-07-10T20:57:34.618765Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.995970Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"7b1cccae-5687-44cd-bf57-16c4e754af68","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5833ad041246d80f220cc7af7daa0496c1565f9dd30b15e77a0c0a8548924421","observation_id":"8498b9a2-783a-42af-a588-a4f42146d381","resolution":{"observed_at":"2026-07-10T20:57:36.021153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":"1908.10084","doi":"10.48550/arxiv.1908.10084","metadata_source":"pith","pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-07-10T20:57:34.817516Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","venue":"cs.CL","work_id":"27adfcc9-2a67-43d6-a844-78309012411f","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:1f03675a26c8a89d1448e55cd7b3e8f0f6023183ca2cbb602aaef6344d86cc18","observation_id":"a4f8249c-778a-4485-b6fd-04502f4c4d7d","resolution":{"observed_at":"2026-07-10T20:57:34.831848Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.777330Z","title":"CoRR , year=","venue":null,"work_id":"f58ca98c-1964-40d0-ac6c-90c96bc25c50","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ea60f1cfb5cf68d76be5e80201c41d667f97ecc8aa5795f1cf8cae85653d1ac7","observation_id":"bc218119-2b26-42b5-b438-2785c361117b","resolution":{"observed_at":"2026-07-10T20:57:35.791875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.08127","last_updated":"2026-04-25T05:20:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-11T16:04:47Z","title":"BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks","version":2},"cited_work":{"arxiv_id":"2508.08127","doi":"10.48550/arxiv.2508.08127","metadata_source":"pith","pith_arxiv_id":"2508.08127","snapshot_observed_at":"2026-07-10T20:57:34.880550Z","title":"BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks","venue":"cs.AI","work_id":"1267acfe-e53b-4c7d-9316-49d0ab6b59ce","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.08127","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:fe5bd9de702d1eb37ee9e64b2c92308ab7ab43327634b861896efe6532fe182b","observation_id":"353d667a-60b1-40a1-9553-c806d75f3ee2","resolution":{"observed_at":"2026-07-10T20:57:34.895863Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07283","last_updated":"2024-10-09T11:01:29Z","snapshot_observed_at":"2026-08-02T17:12:52.352951Z","submitted_at":"2024-10-09T11:01:29Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2410.07283","doi":"10.48550/arxiv.2410.07283","metadata_source":"pith","pith_arxiv_id":"2410.07283","snapshot_observed_at":"2026-07-10T20:57:34.951275Z","title":"Prompt Infection: LLM-to-LLM Prompt Injection within Multi-Agent Systems","venue":"cs.MA","work_id":"17359a70-8c04-4709-a6db-aa38995d867e","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.07283","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6af6be190eedd31e78fb0a1f985925d4d858a2d91c16859f5f3a537c0fde10b3","observation_id":"3ad51200-cecc-4b01-9970-597a8073d419","resolution":{"observed_at":"2026-07-10T20:57:34.967267Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:34.441537+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:34.441537+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.746605Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"93b48608-4532-44cd-ae12-5357c8fb17d6","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8793d948f6c95efe35d1bf56a3cb8ebe3009b413a5f1ae24d0db04a53459adaa","observation_id":"0c45dc3c-de5d-4392-bb25-9cb66b9c5988","resolution":{"observed_at":"2026-07-10T20:57:35.761375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05605","last_updated":"2025-04-08T01:36:16Z","snapshot_observed_at":"2026-08-02T05:27:21.658804Z","submitted_at":"2025-04-08T01:36:16Z","title":"ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs","version":1},"cited_work":{"arxiv_id":"2504.05605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.05605","snapshot_observed_at":"2026-07-10T20:57:34.661760Z","title":"ShadowCoT: Cognitive Hijacking for Stealthy Reasoning Backdoors in LLMs","venue":"cs.CR","work_id":"20528232-9520-471b-b7b9-da677c306462","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2504.05605","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ffa1ea507a5a34cb605d7de680e5634c15ed5694ff34ef3e3d2834b1aea5787b","observation_id":"6158eaf3-4304-489f-9535-a3edfadc9e6f","resolution":{"observed_at":"2026-07-10T20:57:34.676550Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15686","last_updated":"2024-10-21T06:54:27Z","snapshot_observed_at":"2026-08-04T07:28:02.629995Z","submitted_at":"2024-10-21T06:54:27Z","title":"NetSafe: Exploring the Topological Safety of Multi-agent Networks","version":1},"cited_work":{"arxiv_id":"2410.15686","doi":"10.48550/arxiv.2410.15686","metadata_source":"pith","pith_arxiv_id":"2410.15686","snapshot_observed_at":"2026-07-10T20:57:34.940717Z","title":"Netsafe: Exploring the topological safety of multi- agent networks","venue":"cs.MA","work_id":"e1f9e23e-4c0a-423c-83e3-6537a32548dc","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.15686","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:eb7a2c067aa8c7fbea51e99159e97819437486a8ceb95706851b28eaa3d12479","observation_id":"7952af6e-b8fc-4efd-b145-9f88c424643d","resolution":{"observed_at":"2026-07-10T20:57:34.955947Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04392","last_updated":"2025-07-08T04:14:01Z","snapshot_observed_at":"2026-08-02T13:08:34.523740Z","submitted_at":"2025-03-06T12:41:54Z","title":"AgentSafe: Safeguarding Large Language Model-based Multi-agent Systems via Hierarchical Data Management","version":2},"cited_work":{"arxiv_id":"2503.04392","doi":"10.48550/arxiv.2503.04392","metadata_source":"pith","pith_arxiv_id":"2503.04392","snapshot_observed_at":"2026-07-10T20:57:34.989623Z","title":"Agentsafe: Safeguarding large language model-based multi- agent systems via hierarchical data management","venue":"cs.AI","work_id":"63b48ec2-507c-4b82-940a-c1d2a2372c47","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2503.04392","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:67a1bc6d409352a6f3a6f24c05e2abf6bfd8a6a13ee7ad8ce824d7542ac6c65a","observation_id":"98530c8e-0028-407a-97b7-c06aef7814a6","resolution":{"observed_at":"2026-07-10T20:57:35.010016Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02546","last_updated":"2026-04-14T05:32:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-03T07:32:57Z","title":"To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems","version":2},"cited_work":{"arxiv_id":"2506.02546","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02546","snapshot_observed_at":"2026-07-10T20:57:34.696561Z","title":"To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems","venue":"cs.CR","work_id":"fb0a3a3a-36fc-408f-b1ce-8ea6fa03f08b","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2506.02546","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:14e89638d5a00a108f05a4ac7c9aad083b630b03fbd6c831dfe2a125de59646d","observation_id":"6bf9402b-c279-4327-8b45-60adb90a03de","resolution":{"observed_at":"2026-07-10T20:57:34.711526Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02691","last_updated":"2024-08-04T04:52:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-05T06:21:45Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","version":3},"cited_work":{"arxiv_id":"2403.02691","doi":"10.1145/3696410.3714756","metadata_source":"pith","pith_arxiv_id":"2403.02691","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","venue":"cs.CL","work_id":"5cbfcda4-ec26-44e4-be60-e1525956d71d","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2403.02691","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:2aeafed99cca7d4761153bfdbb1865a8af7cbc86e7225695bda1e647302b51c9","observation_id":"93a17037-9778-4e16-9707-cf053bf1762b","resolution":{"observed_at":"2026-07-10T20:57:34.477702Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.836721Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":"10e93277-28fe-40ad-a208-fa71bec9d4fc","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:21f9dfbb2b69798307e925d75158f7521f222b96f49c575dcb55d63af7a863cc","observation_id":"321f68f8-c1a3-4cef-8c88-dbd02a0ef42f","resolution":{"observed_at":"2026-07-10T20:57:35.857734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.153938Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"39654060-3c03-42af-9e57-f5189eb6bfce","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ff817e127bba44a868b22ab12c1ba1dd7a5841ed52c130e06735461cadfcd4c6","observation_id":"365bbf48-02d5-46f0-a15b-2f4c58dec515","resolution":{"observed_at":"2026-07-10T20:57:36.174160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14859","last_updated":"2024-06-03T03:29:07Z","snapshot_observed_at":"2026-07-06T17:34:11.950339Z","submitted_at":"2024-02-20T23:08:21Z","title":"The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative","version":2},"cited_work":{"arxiv_id":"2402.14859","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.14859","snapshot_observed_at":"2026-07-10T20:57:34.775593Z","title":"The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative","venue":"cs.CR","work_id":"849458c0-eae1-4e87-81d5-a6d056d48129","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2402.14859","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:ecce4dbcf8e35cd377585de1c30280f0b8dc3f0b2aeeb054e380661fed1f0c22","observation_id":"6ac94365-f39f-404a-9f39-e5e449603e18","resolution":{"observed_at":"2026-07-10T20:57:34.794177Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.678235Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":"f640491e-2dfe-4c1a-9f75-2c2485da1bc4","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:7b69235192fc6d4122c96cbf8410368a311adfb92051e66b4fc6017d2e0b9f56","observation_id":"85d9a114-59d5-43d3-84df-2809fe9704a6","resolution":{"observed_at":"2026-07-10T20:57:35.693133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18572","last_updated":"2025-05-24T07:24:29Z","snapshot_observed_at":"2026-07-06T21:29:45.699731Z","submitted_at":"2025-05-24T07:24:29Z","title":"MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework","version":1},"cited_work":{"arxiv_id":"2505.18572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18572","snapshot_observed_at":"2026-07-10T20:57:34.404122Z","title":"MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework","venue":"cs.MA","work_id":"0f86285a-df53-4764-9ae0-4069e0769e01","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2505.18572","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:157c47b00c6d80e6daf9fc06e9b1de99dc871b7ac1abf01d914ff817eecc7936","observation_id":"781349bf-0d3e-448f-853e-5b81caaf5c90","resolution":{"observed_at":"2026-07-10T20:57:34.420095Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14529","last_updated":"2025-02-20T13:02:00Z","snapshot_observed_at":"2026-07-06T20:39:47.920307Z","submitted_at":"2025-02-20T13:02:00Z","title":"CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models","version":1},"cited_work":{"arxiv_id":"2502.14529","doi":"10.48550/arxiv.2502.14529","metadata_source":"pith","pith_arxiv_id":"2502.14529","snapshot_observed_at":"2026-07-10T20:57:34.500888Z","title":"Corba: Contagious recursive blocking attacks on multi- agent systems based on large language models","venue":"cs.CL","work_id":"17edf756-49eb-4862-9f9c-c8637e59173c","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.14529","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8d94b544e28827ef97a364d4c455166017300c83090e5f1a75e096f345862f00","observation_id":"6660901d-8185-4d8e-98a3-eb2e2e5497c2","resolution":{"observed_at":"2026-07-10T20:57:34.516433Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.00218","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:34.971136Z","title":"arXiv preprint arXiv:2504.00218 , year=","venue":null,"work_id":"a1ead14c-ace3-4c4f-9f03-25915ca48302","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:e9a404ec9464072ac8c4a14dda408482e39a67e6eaff2b89421cc2afdb378d40","observation_id":"0b5adbac-d96e-40f3-9d41-9199e0a12384","resolution":{"observed_at":"2026-07-10T20:57:34.986010Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11855","last_updated":"2024-02-02T08:28:01Z","snapshot_observed_at":"2026-07-06T16:50:02.155961Z","submitted_at":"2023-11-20T15:50:09Z","title":"Evil Geniuses: Delving into the Safety of LLM-based Agents","version":2},"cited_work":{"arxiv_id":"2311.11855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.11855","snapshot_observed_at":"2026-07-10T20:57:34.626195Z","title":"Evil geniuses: Delving into the safety of llm-based agents","venue":"cs.CL","work_id":"e13aaabf-88ce-407e-8517-ac57b98525d5","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2311.11855","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:72d71a8c573c756711ffa89ffe34d1817159458382311d387f37fff09dd6f4ea","observation_id":"e97679e3-2fbd-4dbb-9ea3-8b1432a727d3","resolution":{"observed_at":"2026-07-10T20:57:34.640349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05499","last_updated":"2025-12-29T02:25:27Z","snapshot_observed_at":"2026-07-06T15:40:27.639368Z","submitted_at":"2023-06-08T18:43:11Z","title":"Prompt Injection attack against LLM-integrated Applications","version":3},"cited_work":{"arxiv_id":"2306.05499","doi":"10.48550/arxiv.2306.05499","metadata_source":"pith","pith_arxiv_id":"2306.05499","snapshot_observed_at":"2026-07-11T02:47:49.696576Z","title":"Prompt Injection attack against LLM-integrated Applications","venue":"cs.CR","work_id":"977b4683-bba6-49d6-8f3d-496c41cb7fac","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2306.05499","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:27c5e301438e5ca52dad4ac9e9ccedaa002eb5e22d5da75510538a31b76c4e45","observation_id":"4757c623-4dc7-40e2-9b41-1c2f4c92c554","resolution":{"observed_at":"2026-07-10T20:57:34.791596Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.726030Z","title":"First Conference on Language Modeling , year=","venue":null,"work_id":"9f93e065-7c5f-4d0b-9f39-cbbfbcc40246","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:40d7239df704798211ba66018036cc42071cc6ddf94e5b3a49139429007495e1","observation_id":"e7c56370-d53c-496a-a2c0-1cccdb746ec2","resolution":{"observed_at":"2026-07-10T20:57:35.741634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":"2306.03314","doi":"10.48550/arxiv.2306.03314","metadata_source":"pith","pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-07-10T20:57:34.363547Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","venue":"cs.AI","work_id":"6ed8494c-c488-407e-b9c0-61e9a411ce26","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:620805067737c535f5f301215836c7dd02c0f81db751c1c49fee970fc24748ef","observation_id":"5da83382-3df8-4c5a-aaf7-c5aa91567828","resolution":{"observed_at":"2026-07-10T20:57:34.378672Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.184806Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"0d31ce7e-f193-44c7-8214-dfb8eb3f9c3d","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:44212741fbd48108433a2674bc7e52e458bd8c4753531bb63b711d4de7cdba88","observation_id":"dcbf6041-11e0-4685-86eb-13feedf545d8","resolution":{"observed_at":"2026-07-10T20:57:36.201393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.082879Z","title":null,"venue":null,"work_id":"c03e1081-b952-48b6-952a-a137c830f973","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:2bc79e0bce009255a76619516843b19626baa0baef359042807d59b0ace6b5c3","observation_id":"c18d4442-0df3-4f2c-97e6-b9dea02779ee","resolution":{"observed_at":"2026-07-10T20:57:36.101515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.798971Z","title":null,"venue":null,"work_id":"c66125cc-4749-4908-8155-a2f126bf7fce","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:d14ef4bb77ac60367ead6c6e81b4da43a75fd7b47872185a18e1b414d9d2f69f","observation_id":"5a59725c-5db6-4df6-8a3d-29cf77131395","resolution":{"observed_at":"2026-07-10T20:57:35.812605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17161","last_updated":"2024-02-27T02:47:50Z","snapshot_observed_at":"2026-07-06T17:35:57.887470Z","submitted_at":"2024-02-27T02:47:50Z","title":"Large Language Model for Participatory Urban Planning","version":1},"cited_work":{"arxiv_id":"2402.17161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.17161","snapshot_observed_at":"2026-07-10T20:57:34.643826Z","title":"Large language model for participatory urban planning","venue":"cs.AI","work_id":"f2f4782b-7239-4f8b-a03c-bd1ced17bce8","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2402.17161","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:7a545457c4f196d3bd7aeb811f33a671d1244f63af194242052b83329f386f16","observation_id":"e6bab736-a335-4b58-af68-e75101e2c6f4","resolution":{"observed_at":"2026-07-10T20:57:34.658027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.715926Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":"a6f2c101-ced5-453b-9e8c-36c4fd9551b1","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:dc9d77831a9f92d7855d387b1a288204fd763211576fcd7990a606fabe29e9d1","observation_id":"46ff4a73-d4c3-400b-a725-a5d50027237c","resolution":{"observed_at":"2026-07-10T20:57:35.732928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.128533Z","title":"Proceedings of the 2024 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"3afc4370-e8bd-4492-b99c-5f9cc19cd503","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:7c29f2eee41e0b24343c3aeb7db934fd64faf7b5b6da9edb5ca898c1a0541ecf","observation_id":"c8df579f-deee-47f6-8fbf-15771e9f4fbf","resolution":{"observed_at":"2026-07-10T20:57:36.150619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.737441Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"44940506-60da-47fb-a734-bf5bba9cd5fd","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:a9df270232ec96cf78c5fe2b18d1067d04f8bbc19d82bb3684067ecaa3973f71","observation_id":"cc6ffbf2-7af3-42c4-8f0e-8647a82fb78a","resolution":{"observed_at":"2026-07-10T20:57:35.755585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.104437Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"db61c55f-a12c-44fe-a54a-675cd2c2cfdc","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:714acaf7baa9388223d513108186c6e76e6f82ca2ca3f0fc26dba13aeba7feec","observation_id":"6816b258-4640-4cef-a02e-4e56f57bd002","resolution":{"observed_at":"2026-07-10T20:57:36.124849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.176740Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"3a3e6b9d-ac58-48ea-80f8-85fec77890e4","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:06657a829bedc0ad43fea2420aa67cbb3513133bdfd5fc15ec517cfe9f5d388c","observation_id":"124c36e0-98f4-4f90-a407-90f1939d1605","resolution":{"observed_at":"2026-07-10T20:57:36.194167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.129664Z","title":"2023 IEEE International Conference on Data Mining (ICDM) , year=","venue":null,"work_id":"e0d46201-8497-4600-8eaf-5652075f3ff6","year":2023},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:9f874fe154987d0fe09f985f82376d3f6fab1194503c89dee4bd5a186f4b4319","observation_id":"4be6e1ec-8e57-49db-a1d2-c2cf32f1cb06","resolution":{"observed_at":"2026-07-10T20:57:36.161683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.058846Z","title":null,"venue":null,"work_id":"df8b6c8b-76b7-4c5e-9a56-7095787d5d1b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:3a198a4fd14fda00c4073306f85e61acec42e67dc0d67ad8d931416889483652","observation_id":"b00b1bde-ad4b-4ea9-9df8-ea3af2c07c2d","resolution":{"observed_at":"2026-07-10T20:57:36.079001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.003391Z","title":", author=","venue":null,"work_id":"2b140c62-8d93-47cc-9ab5-3c89ef184f72","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:5eebabfa2ab6a7eb275b9ef0f65a89a3ea760290e4f122b4df33649950afb186","observation_id":"cec6a989-10fc-49e7-b3a5-11983b085f6b","resolution":{"observed_at":"2026-07-10T20:57:36.023043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:36.023528Z","title":null,"venue":null,"work_id":"42d2d08b-e44a-4ec6-a2ab-cdce7c5245db","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6f1e5f1e8bfa44b88f152434937246e93eb8386b4c1c3e1cd2aa388886025442","observation_id":"fc2df9e2-f8fc-4617-bc11-395765a58e6e","resolution":{"observed_at":"2026-07-10T20:57:36.051407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22606","last_updated":"2025-07-30T12:22:30Z","snapshot_observed_at":"2026-08-02T22:59:12.946234Z","submitted_at":"2025-07-30T12:22:30Z","title":"MetaAgent: Automatically Constructing Multi-Agent Systems Based on Finite State Machines","version":1},"cited_work":{"arxiv_id":"2507.22606","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.22606","snapshot_observed_at":"2026-07-10T20:57:34.446889Z","title":"arXiv preprint arXiv:2507.22606 , year=","venue":"cs.AI","work_id":"1603f206-ccdf-4328-b817-dd2ee8466ae9","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2507.22606","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:fc25072fe7c35b1a50181449fa6c161d51e30e32314c63c379a6a03929fef58c","observation_id":"d95dc51a-1ab4-412d-a391-418669950e9d","resolution":{"observed_at":"2026-07-10T20:57:34.461963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04180","last_updated":"2025-06-09T05:15:47Z","snapshot_observed_at":"2026-07-06T20:32:18.814472Z","submitted_at":"2025-02-06T16:12:06Z","title":"Multi-agent Architecture Search via Agentic Supernet","version":2},"cited_work":{"arxiv_id":"2502.04180","doi":"10.48550/arxiv.2502.04180","metadata_source":"pith","pith_arxiv_id":"2502.04180","snapshot_observed_at":"2026-07-10T20:57:34.680069Z","title":"Zhang, L","venue":"cs.LG","work_id":"749a42f9-4e3e-42a9-b050-d9e44b9719e8","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2502.04180","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:cac32b17e8017ef4321c8f5e76d31ef0c2bf5e4afcb56f108cf76e63771fd5ba","observation_id":"5b2a31db-111b-4d64-a1c8-198d2506288c","resolution":{"observed_at":"2026-07-10T20:57:34.694548Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.370655+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.370655+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10762","last_updated":"2025-04-15T02:44:55Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:40:40Z","title":"AFlow: Automating Agentic Workflow Generation","version":4},"cited_work":{"arxiv_id":"2410.10762","doi":"10.48550/arxiv.2410.10762","metadata_source":"pith","pith_arxiv_id":"2410.10762","snapshot_observed_at":"2026-07-10T20:57:34.890252Z","title":"AFlow: Automating Agentic Workflow Generation","venue":"cs.AI","work_id":"7418aa37-1972-4dd5-8da6-c588dfce4c5b","year":2024},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2410.10762","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:6ac9aa48d04252d763e5ef9ae2b46ec46d434aaef07c68fa8589f4c34ad7fbd7","observation_id":"8fcc7553-0acd-40c6-9583-6dfc4affe828","resolution":{"observed_at":"2026-07-10T20:57:34.906236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.107327+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.107327+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.815175Z","title":"ICPR , pages=","venue":null,"work_id":"df06cf84-9c8d-4516-98f3-9f2bd0be835b","year":2016},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:a72ab4f2fd6a6725dfad046c660fd825a0ca4731a25eb6b504c89543aa178445","observation_id":"940d5ae8-7013-4b98-997c-f90de31fc713","resolution":{"observed_at":"2026-07-10T20:57:35.834384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:57:35.668833Z","title":"Sensors , volume=","venue":null,"work_id":"814a4454-558e-476a-9555-b232e19e6525","year":2019},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:8f15899ed4664705b869591567bdfac0b036d8f84b93e729e07c81173d4b2d8f","observation_id":"f0735b64-a0ab-4127-97fc-cb3e41555077","resolution":{"observed_at":"2026-07-10T20:57:35.682714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:54.372474Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":"da360c40-6481-4088-bd96-8e73e0280a6b","year":null},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:c7f82460eaf5761d4d6f978b11f2cb0db8969361ddc9ca1aff3289ff42b3edce","observation_id":"dcc6986a-47b0-47d3-b7e4-f8f63fae48b9","resolution":{"observed_at":"2026-07-10T20:57:36.126079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03125","last_updated":"2025-08-05T06:14:53Z","snapshot_observed_at":"2026-08-03T03:47:07.177481Z","submitted_at":"2025-08-05T06:14:53Z","title":"Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS","version":1},"cited_work":{"arxiv_id":"2508.03125","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03125","snapshot_observed_at":"2026-07-10T20:57:34.795349Z","title":"Attack the Messages, Not the Agents: A Multi-round Adaptive Stealthy Tampering Framework for LLM-MAS","venue":"cs.CR","work_id":"7261bcb2-6754-4be6-8e9c-f084e7d1fade","year":2025},"citing_paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-07-10T20:55:21.031591Z"},"links":{"cited_paper":"/paper/2508.03125","citing_paper":"/paper/2607.06807"},"observation_digest":"sha256:094b70e889a1e6ec6786f90419d3e7bd4b5b3397bd0740a5ae3e2d8805cc85d1","observation_id":"5b6114b8-3d60-4d89-9034-5b3a49d97c3f","resolution":{"observed_at":"2026-07-10T20:57:34.810598Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.06807","last_updated":"2026-07-07T21:12:27Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-11T23:18:38.425203Z","submitted_at":"2026-07-07T21:12:27Z","title":"When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":35,"parse_uncertain":0,"unresolved":5,"verified_exact":2,"verified_fuzzy":37},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 0 inbound Pith citation observations for arXiv:2607.06807."}