{"as_of":"2026-08-09T08:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1349621f520c81f39c9df5566389446af3ba033c6fc6f1639caf57e590156cb","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:17:13.027364Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T18:58:53.183734Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T19:00:30.421345Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"cited_work":{"arxiv_id":"2508.03864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03864","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evo-marl: Co-evolutionary multi-agent reinforcement learning for internalized safety","venue":null,"work_id":"f63eaa74-f4f1-489c-b6c6-c47df22bb31f","year":2025},"citing_paper":{"arxiv_id":"2511.12710","last_updated":"2026-05-18T06:50:41Z","snapshot_observed_at":"2026-07-06T22:35:55.936840Z","submitted_at":"2025-11-16T17:52:07Z","title":"Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T18:58:53.183734Z"},"links":{"cited_paper":"/paper/2508.03864","citing_paper":"/paper/2511.12710"},"observation_digest":"sha256:7f958cc3ae3b7bca0a0e3e98c5ca2a88f963bf4e56b476eb60bee973986d1aab","observation_id":"76e6783f-e53e-49ae-baf6-8a3465b90fb8","resolution":{"observed_at":"2026-05-21T19:00:30.423456Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.03864/citation-record","integrity":"/paper/2508.03864/integrity","json":"/paper/2508.03864/citation-record.json","paper":"/paper/2508.03864"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:21.715337Z","title":"Improving retrieval-augmented generation through multi-agent reinforcement learning, 2025","venue":null,"work_id":"85192d9d-7acb-4e2c-8c99-95e452792d6e","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.034162Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:1685a2e13f8c69915d767b7025429f7a8f566ea34bbfb949ff9b82a4648a0e38","observation_id":"bd9bd894-7267-43b7-8062-5e0173a34f7c","resolution":{"observed_at":"2026-08-06T04:17:21.797033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:21.534085Z","title":"Agentpoison: Red-teaming llm agents via poisoning memory or knowledge bases, 2024","venue":null,"work_id":"6b170ce8-2fd7-45a6-949c-e4b99fa9504f","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.175865Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:7f1018b960dc16a1d1e59e899682b64cc7d613edb13c8512d0c693f3b2bcf80d","observation_id":"563fde29-6a1e-49ba-9089-0e7ebe47144d","resolution":{"observed_at":"2026-08-06T04:17:21.614175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:08.292580Z","title":"Deepseek-r1: Incentivizing reasoning capa- bility in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.292580Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:9c79899a33b2f77c7283aa269aea1a9bec2aaded22581651de3c238333f7135c","observation_id":"c6b559a9-3b6a-49c1-b5e5-5dda9b771f89","resolution":{"observed_at":"2026-08-06T04:17:08.292580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:21.235424Z","title":"Multilingual jailbreak challenges in large language models, 2024","venue":null,"work_id":"fb84e9e4-39c2-41fd-bd49-0c825db993b4","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.401691Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:750910bbde4de065e1c5de7754ee4ec2b66ddf36bb755794ca0e4fffa64b2bc0","observation_id":"3baf1983-0e9d-49ef-9693-4d51b3a54e74","resolution":{"observed_at":"2026-08-06T04:17:21.390561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:21.008949Z","title":"A practical memory injection attack against llm agents, 2025","venue":null,"work_id":"88cae052-d58b-4922-8a5d-d1110be85487","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.541064Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:0fd6a41720f967cc56f2c98278091f3bcb7e7a700b0cd5a7df9fbdcc1d622967","observation_id":"be55f796-742a-447e-b510-eb7230a1e39a","resolution":{"observed_at":"2026-08-06T04:17:21.121642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:20.592960Z","title":"Peerguard: Defending multi-agent systems against backdoor attacks through mutual reasoning,","venue":null,"work_id":"df94010a-ee6e-4600-8cbc-02cd3f669fd8","year":null},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.674109Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:8c53c62cd00b0807b9349a8d68efe4243ca6fd1c60f72b7f06aa2188204094b6","observation_id":"84c03e86-b527-479e-8d22-668b94824e67","resolution":{"observed_at":"2026-08-06T04:17:20.777722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:20.217775Z","title":"Not what you’ve signed up for: Compromising real-world llm-integrated ap- plications with indirect prompt injection, 2023","venue":null,"work_id":"c343c2df-368b-4023-8b06-42226544fcdc","year":2023},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.750735Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:d4934ebf034f9fe33c62b5026e7715294506f22667aa3ca3c6068c3d10bf66fa","observation_id":"00c19c84-6117-4bf4-8b22-ab6470007ec3","resolution":{"observed_at":"2026-08-06T04:17:20.414779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:19.927363Z","title":"Llm multi-agent systems: Challenges and open problems, 2025","venue":null,"work_id":"9dfaa44a-b177-4b07-81f7-1273fa84b70c","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.835851Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:2065e33b64d1afad50149eb0b259d835bcad920ccd4fb3c62c107ed96d0bdd69","observation_id":"a8e70d4c-72fb-4780-a4f6-80e62addbec8","resolution":{"observed_at":"2026-08-06T04:17:20.053410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:19.578907Z","title":"Red-teaming llm multi-agent systems via commu- nication attacks, 2025","venue":null,"work_id":"e0b2e154-dab7-4c66-a8e0-6eb8b7d56a77","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:08.902413Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:04027f878b167468b66bd3762c402158632c5c104d409de4e7cb8da004255fc3","observation_id":"438d1589-163d-4f7c-865f-9bedbfe11013","resolution":{"observed_at":"2026-08-06T04:17:19.752036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:19.345470Z","title":"Measuring mathematical problem solving with the math dataset, 2021","venue":null,"work_id":"9531c5f2-462b-4edd-93c0-d83720f850de","year":2021},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.019799Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:91488002c52aa0afc2cef4aad1524e79dc29a1950ef4741eb21fa24e9c10cf2e","observation_id":"c67e3a34-d65b-43b3-b3c5-4a5afc1c68e9","resolution":{"observed_at":"2026-08-06T04:17:19.453212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:19.012307Z","title":"Llama guard: Llm-based input-output safeguard for human-ai con- versations, 2023","venue":null,"work_id":"4a624dd5-b9ce-478f-bec9-0e75ebc42d7b","year":2023},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.190821Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:b73083f04d5873a7b3f0876b9d1a1508072521e6d817402e87ae5d943e6f955d","observation_id":"2a341dd6-e818-45f6-8273-9fa6e85da5a1","resolution":{"observed_at":"2026-08-06T04:17:19.144675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:18.703732Z","title":"Search- r1: Training llms to reason and leverage search engines with reinforcement learning, 2025","venue":null,"work_id":"b6bdff6d-000f-4d26-bfe2-17ecc0dcae1e","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.279321Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:f5c713aeb2d7d8812494c88beb049e140fe04072e6583af12c17f028f4ccbbd5","observation_id":"c633c3ff-51e4-466e-ba03-ead9e4384812","resolution":{"observed_at":"2026-08-06T04:17:18.829033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:18.439302Z","title":null,"venue":null,"work_id":"2d63c100-7f10-42b7-a1e9-1df39234216f","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.394713Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:97684dc18513da75292b16b8e6023f9ab484d6ef44e9c9946e640633b9a0db66","observation_id":"b8bf145c-aa84-451a-86ca-f7c230af4dd8","resolution":{"observed_at":"2026-08-06T04:17:18.524994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:18.247509Z","title":"Trust re- gion policy optimisation in multi-agent reinforcement learn- ing, 2022","venue":null,"work_id":"8273229f-e682-4eca-a1e3-37b28ab0f105","year":2022},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.477475Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:af9ca3a99bd422677f07a27ffd6fd92d6959683e72c24d0e2e8acc61df0aeebe","observation_id":"d2312e4f-b055-4103-a084-17f8bd5ffb13","resolution":{"observed_at":"2026-08-06T04:17:18.351198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:18.052736Z","title":"Prompt infection: Llm-to- llm prompt injection within multi-agent systems, 2024","venue":null,"work_id":"07e4352d-9c62-4510-ae88-e6feefe6b148","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.615213Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:0b4d7af2573efb47255975fbdb06461a3266e73d4c920f5abf7e8f111bee8944","observation_id":"3abee350-f220-43c3-a556-2c46afef842e","resolution":{"observed_at":"2026-08-06T04:17:18.131372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.853154Z","title":"Deepinception: Hypnotize large language model to be jailbreaker, 2024","venue":null,"work_id":"21213d97-a1e9-44af-ab24-1abe7ccf845e","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.701866Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:3d7eca19a65d3b10ed36dd5eceb42ebbf402d08ed1e97ac53e4ab71cc354c649","observation_id":"0d027fcb-cd73-457d-815b-59f282d5bedf","resolution":{"observed_at":"2026-08-06T04:17:17.931362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.689855Z","title":"Tf-attack: Transferable and fast adversarial attacks on large language models, 2024","venue":null,"work_id":"0a88d19f-f693-4467-b709-f7cd184ef9a1","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.794018Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:ec7f706a135411ac79631d12f3af2586aed66660f2750459b97cc1420385f649","observation_id":"3aaee5ab-09c9-41fd-a037-a51cb2150694","resolution":{"observed_at":"2026-08-06T04:17:17.769154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.545271Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models, 2024","venue":null,"work_id":"fd4497c6-98bb-4f11-9dcb-31a828853caf","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.885976Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:f2a878d4f75392dc7507aee9261e7f8db3ecfbcdc5e8739a6a5f733e733b4ebc","observation_id":"9ea0f7f3-6939-47e1-af4d-b57dbbb0846e","resolution":{"observed_at":"2026-08-06T04:17:17.613247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.357855Z","title":"Jailbreakv: A benchmark for assessing the robustness of multimodal large language models against jail- break attacks, 2024","venue":null,"work_id":"1abe2ed6-ea69-4190-bd46-7305ee47207f","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:09.968243Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:3879e84fc04c5b21bbc4870c17f6b80d4baeddda0a09234698cc0bed6ebaa9b3","observation_id":"dc5de2ff-03af-4183-821d-9d360b7cd6cc","resolution":{"observed_at":"2026-08-06T04:17:17.448546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.217995Z","title":"Codechameleon: Personalized encryption frame- work for jailbreaking large language models, 2024","venue":null,"work_id":"5c712eba-5580-4c58-bfc3-5b7bcbe4cc73","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.089362Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:e2cce95f903907444685df62c8341373e674741f5ada402e2b8826104cc2e300","observation_id":"6b73d23f-c53a-4e18-9395-705fc64b6b13","resolution":{"observed_at":"2026-08-06T04:17:17.286041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:17.143367Z","title":"Harm- bench: A standardized evaluation framework for automated red teaming and robust refusal, 2024","venue":null,"work_id":"e8ea7996-4c08-4f26-b47b-ec944f0675f6","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.209297Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:2e2bea5e0b14cb42c0a81286ea8cf69cfa8c5906651220fa818552d6c1a845ff","observation_id":"fc82ba90-e4b7-4cd4-a863-28a7e9356d1e","resolution":{"observed_at":"2026-08-06T04:17:17.210645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:10.290349Z","title":"Metaspatial: Reinforcing 3d spa- tial reasoning in vlms for the metaverse.arXiv preprint arXiv:2503.18470, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.290349Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:dd1810c8ea498619081596a790449ea968a0d926a82f167515187381408c51b6","observation_id":"172ba3d1-7225-4121-877c-619737d097b6","resolution":{"observed_at":"2026-08-06T04:17:10.290349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01353","last_updated":"2024-10-24T06:24:56Z","snapshot_observed_at":"2026-08-03T21:59:19.065952Z","submitted_at":"2024-10-02T09:11:10Z","title":"Codev-Bench: How Do LLMs Understand Developer-Centric Code Completion?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01353","snapshot_observed_at":"2026-08-06T04:17:10.380062Z","title":"Codev- bench: How do llms understand developer-centric code com- pletion?arXiv preprint arXiv:2410.01353, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.380062Z"},"links":{"cited_paper":"/paper/2410.01353","citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:3fc5669868506a126c5b24cb43a6e1290312bd037a2c0f1d8b9554e1d2a25a0d","observation_id":"dcfa71a7-5459-452b-b77c-4839d76b6df8","resolution":{"observed_at":"2026-08-06T04:17:10.380062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17359","last_updated":"2025-02-21T09:32:54Z","snapshot_observed_at":"2026-08-04T14:19:33.280906Z","submitted_at":"2024-03-26T03:51:01Z","title":"Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17359","snapshot_observed_at":"2026-08-06T04:17:10.475488Z","title":"Chain-of-action: Faithful and multimodal question an- swering through large language models.arXiv preprint arXiv:2403.17359, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.475488Z"},"links":{"cited_paper":"/paper/2403.17359","citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:4737d586ae562bfb1708b8b0225e1bc3fcd85cecfd410bd02379392e4d203c22","observation_id":"a9cd9caf-e8d6-4c21-8bd6-cf11e8a8ad7b","resolution":{"observed_at":"2026-08-06T04:17:10.475488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17822","last_updated":"2024-05-28T04:46:52Z","snapshot_observed_at":"2026-07-06T18:21:05.410042Z","submitted_at":"2024-05-28T04:46:52Z","title":"Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17822","snapshot_observed_at":"2026-08-06T04:17:10.574459Z","title":"Conv-coa: Improving open-domain question answering in large language models via conversational chain-of-action","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.574459Z"},"links":{"cited_paper":"/paper/2405.17822","citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:b8ec0a6b5171f8c0cdca99a9f94b0bfaada1ba69968686530904c6827c12d686","observation_id":"7d953f70-da50-44d8-913c-25ea686208ab","resolution":{"observed_at":"2026-08-06T04:17:10.574459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.979901Z","title":"Do code llms understand design patterns? In2025 IEEE/ACM Inter- national Workshop on Large Language Models for Code (LLM4Code), pages 209–212","venue":null,"work_id":"6d9b6cec-7f98-4480-b9fa-b261312cb117","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.694884Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:fa49bb00d92538ed9d5ad886a42a0a9426e90b0461e287f548a54964abffa416","observation_id":"26f531b3-0c99-4667-9d91-3e65103ea2e0","resolution":{"observed_at":"2026-08-06T04:17:17.070627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.801005Z","title":"Yu, Manling Li, and Han Liu","venue":null,"work_id":"d276c63f-e791-4cc0-9179-de5ee99cebc2","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.828016Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:43d817fb50a10552ecbfa01bfd13049c2c9da4c04cc2adf52b1a8d67c8d42de3","observation_id":"dd25c245-3dfc-493f-ac18-7da47383aca2","resolution":{"observed_at":"2026-08-06T04:17:16.906588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.674393Z","title":"Maporl: Multi-agent post-co-training for collaborative large language models with reinforcement learning, 2025","venue":null,"work_id":"485e0cb5-84e1-4bc0-a725-b9fc4c260aa2","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:10.912276Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:89c06d70e9a9661d77872427cdb3b2ace6ca3ce0f6620d90af8a4b8993e3903f","observation_id":"afb8e609-e62e-4f80-8620-b874fa7db811","resolution":{"observed_at":"2026-08-06T04:17:16.737349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.528587Z","title":"Red teaming the mind of the machine: A systematic evaluation of prompt injection and jailbreak vul- nerabilities in llms, 2025","venue":null,"work_id":"7583441a-e7d6-45e1-977b-1633aaa572ec","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.050008Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:4a3c10311ca5b238e1bb6c4c83933bcb912e701dea0fed7784677d5bd067ad9c","observation_id":"0fbbc2b8-4635-4abb-9151-e7ad4b34d2a3","resolution":{"observed_at":"2026-08-06T04:17:16.581769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.320063Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":"7325f94a-e809-4d4a-aaff-465473d78906","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.156744Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:2d92e940ddb1ac7e9ed77bd13f80bc5e1327f94872cec90d48c1699fdd6a20d2","observation_id":"30435057-2a00-48ea-bb19-38d223ce91a7","resolution":{"observed_at":"2026-08-06T04:17:16.462728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:16.161570Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning, 2018","venue":null,"work_id":"668af158-264c-45d1-a3e3-578e838b19ea","year":2018},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.291722Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:7258228907de6feab1694d0aa8cae9a307bf215e51d6212ddbebcb1d4e560973","observation_id":"f5f5cdb3-ce4f-4001-aad7-796e434fe262","resolution":{"observed_at":"2026-08-06T04:17:16.270429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.983673Z","title":"Proximal policy optimization algo- rithms, 2017","venue":null,"work_id":"4e45ebc9-672a-40f8-93c8-d716d2c3c21c","year":2017},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.390773Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:a6a4f16786606f60c63f4949668e7d1c51190564927f9257d4ac88f8c7c986b7","observation_id":"cd0c0ce3-4ff0-46e8-9a8c-a4a2626487e5","resolution":{"observed_at":"2026-08-06T04:17:16.069560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.821242Z","title":"Exfiltration of personal information from chatgpt via prompt injection, 2024","venue":null,"work_id":"7b684338-e8b9-4045-840b-4b65687883b8","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.468085Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:16586cbb2d4d56e97b57d0628debe224f82c8b388bccaa897c21b8ff63a55887","observation_id":"7313c8ca-3796-41ce-866b-0df1da0a3aac","resolution":{"observed_at":"2026-08-06T04:17:15.898471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:11.579252Z","title":"Sciscigpt: Advancing human- ai collaboration in the science of science.arXiv preprint arXiv:2504.05559, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.579252Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:1c53979f00bc4aef9d0561ae62fbc64bb5e457ae8cf58e710cc33e6246235f6e","observation_id":"e234953e-7426-45a9-ab15-f4820562e85d","resolution":{"observed_at":"2026-08-06T04:17:11.579252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T04:17:11.673708Z","title":"Deepseekmath: Pushing the limits of math- ematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.673708Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:c9cbd183af70af9c2b17be083fd4f701992fe39fc55a8216f29f8b7726643e6a","observation_id":"ee7eff76-68f7-44ac-b859-43b5a7ce914d","resolution":{"observed_at":"2026-08-06T04:17:11.673708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.591913Z","title":"Prompt injection attack to tool selection in llm agents, 2025","venue":null,"work_id":"588954af-e0b7-4a9e-afb4-cd2c7951f9d3","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.775209Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:6f724ea7dba4a991a4800b38f0ce4a1c06b2d716c2007b40752ce25259cb7d5e","observation_id":"5bc28a52-9f95-45d8-be1a-dfaabc07693a","resolution":{"observed_at":"2026-08-06T04:17:15.712033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.394125Z","title":null,"venue":null,"work_id":"9adf89ca-5d39-4194-b192-3591c83852d9","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.868960Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:d3bf8da7a6f331b771dba672b63d9bb17a23866b443b6d3d5749f15b9a706eee","observation_id":"8ce99069-7b5a-4ac8-afea-8b737881ab91","resolution":{"observed_at":"2026-08-06T04:17:15.484083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.221441Z","title":"Multi- agent systems execute arbitrary malicious code, 2025","venue":null,"work_id":"5091b683-5701-43b5-b6af-73bf1a470639","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:11.980418Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:131446b44f26efdeaf2d211d29290f74ae9a2263e76dd6e93ccc52244e2b7b36","observation_id":"c2759c17-5d28-48fd-a776-64d70bbd1d72","resolution":{"observed_at":"2026-08-06T04:17:15.296371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:15.049970Z","title":"Lyu, and Maarten Sap","venue":null,"work_id":"e005ce87-3003-4796-8565-ad64daad784c","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.091016Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:2444e114b0900f5bef331638f92b90a941d92aa7f66239efb32e5daa2e75c62d","observation_id":"a735f8f2-8ca2-4fb3-b43f-be9f120ba091","resolution":{"observed_at":"2026-08-06T04:17:15.122813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:14.892953Z","title":"Rema: Learning to meta-think for llms with multi-agent reinforcement learning, 2025","venue":null,"work_id":"5eb0e83c-b035-45f5-b0d5-3253f669dc39","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.199699Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:8e31341cf8cce25a1a1df655cdb473130550907798e956f7c9026b1d621e734e","observation_id":"8534057d-95d5-4384-b11b-5f76d7b748fb","resolution":{"observed_at":"2026-08-06T04:17:14.972763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:14.726751Z","title":"G- safeguard: A topology-guided security lens and treatment on llm-based multi-agent systems, 2025","venue":null,"work_id":"f1e0c83a-4a11-496c-8dd2-a9987043982f","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.318504Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:c8516d575f310f57c778e6e61ae6010b28ffe84366dc7b715baabe671173e37a","observation_id":"5f09d10d-b5ea-470b-9983-6738b143438c","resolution":{"observed_at":"2026-08-06T04:17:14.794982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:14.558286Z","title":"Unleashing the emergent cogni- tive synergy in large language models: A task-solving agent through multi-persona self-collaboration, 2024","venue":null,"work_id":"1a5738fc-f479-42f5-8ec5-8d432c53e02c","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.409382Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:f019d067a7520415dd387d97ba441e89122c6556251d1cf5dc91a04710ae7d62","observation_id":"f5b6ad89-c513-4b99-82eb-a695d9e10541","resolution":{"observed_at":"2026-08-06T04:17:14.643499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:14.280643Z","title":null,"venue":null,"work_id":"430a9a68-a99f-449f-bb81-d465e94f72c1","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.471241Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:958cf4f36eb1fc4e7672dc948ce2c4950d1d45a49f94a5664ce39f3888ebeaf6","observation_id":"5db696b9-5838-47c4-b9da-cf88ac3b0ded","resolution":{"observed_at":"2026-08-06T04:17:14.448121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:14.110000Z","title":"Beyond self-talk: A communication-centric survey of llm-based multi-agent systems, 2025","venue":null,"work_id":"a125c25f-0c0a-468b-b2d3-9a405f9192f5","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.573521Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:cd3b69af381451bfe3faaf8fbfa07b82d9cea101797a906f951f9ffaae17529f","observation_id":"ecd6e62b-a10c-4132-826c-e8bee689369d","resolution":{"observed_at":"2026-08-06T04:17:14.190529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:13.941811Z","title":"Jailbreak attacks and defenses against large language models: A survey, 2024","venue":null,"work_id":"58eb0f04-ede6-476a-8e59-78945188b343","year":2024},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.724619Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:db7f12d9afb8eef7f9226700abb6901cad61c1c91d24682b133a6e7170815591","observation_id":"a476655e-230b-413d-96f5-3ce7b67cff24","resolution":{"observed_at":"2026-08-06T04:17:14.002521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:13.768999Z","title":"The surprising effec- tiveness of ppo in cooperative, multi-agent games, 2022","venue":null,"work_id":"b5a948e6-a7b6-4563-9957-1b02efff2b9f","year":2022},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.800113Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:5e14b578b19ec53c1b9447270ec28394f15a63d95428a1bdb37e497a238c7ca8","observation_id":"75ea36b8-32cb-4a7b-88be-1357fe5c1fc2","resolution":{"observed_at":"2026-08-06T04:17:13.852226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:13.606846Z","title":"Agent security bench (asb): Formalizing and benchmarking attacks and defenses in llm-based agents,","venue":null,"work_id":"e5a04c28-5895-472a-8801-51860648b464","year":null},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.875825Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:215da683278f59cf4ca75494ac160b3e0868e86bc758849948147cfbb9a32bc3","observation_id":"52a24b10-38cc-42b5-88fb-d5aa4bd7049b","resolution":{"observed_at":"2026-08-06T04:17:13.688356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:13.468194Z","title":"Corba: Contagious recur- sive blocking attacks on multi-agent systems based on large language models, 2025","venue":null,"work_id":"80df533d-d08d-498e-b5a8-ddb97bf0d65c","year":2025},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:12.971097Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:dfb93144ee26a12804954a82962141afa3ee18a7074ed0a48615965c46df5251","observation_id":"bc6697c0-445f-4a7b-8189-e958168c64c1","resolution":{"observed_at":"2026-08-06T04:17:13.539126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:17:13.346664Z","title":"Successful defense on JailBreakV 1","venue":null,"work_id":"8e4fb2d7-4a7c-405d-9110-0afc0fd041f3","year":null},"citing_paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T04:17:13.027364Z"},"links":{"citing_paper":"/paper/2508.03864"},"observation_digest":"sha256:e41e77feeada5cd98c548eb46b2a7a97e3ba840706d895aa0cb2a32e3f73177f","observation_id":"54529aa9-6f4a-4b55-b105-ef3c47614e96","resolution":{"observed_at":"2026-08-06T04:17:13.390325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.03864","last_updated":"2025-09-06T00:06:39Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T04:16:29.928705Z","submitted_at":"2025-08-05T19:26:55Z","title":"Evo-MARL: Co-Evolutionary Multi-Agent Reinforcement Learning for Internalized Safety"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2508.03864."}