{"as_of":"2026-08-23T11:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b61a26e1e350a4b5263b64815719f2f26869f744a97d1d34e0dd2046a4041b7e","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T12:57:19.545442Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:11:42.030356Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T21:11:42.215613Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.17467","snapshot_observed_at":"2026-08-03T00:25:06.559706Z","title":"arXiv preprint arXiv:2605.17467 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28802","last_updated":"2026-07-30T19:55:14Z","snapshot_observed_at":"2026-08-08T06:19:07.682563Z","submitted_at":"2026-07-30T19:55:14Z","title":"Model or Harness? An Interaction-Centric Taxonomy for Localizing Agent Failures","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T00:25:06.559706Z"},"links":{"cited_paper":"/paper/2605.17467","citing_paper":"/paper/2607.28802"},"observation_digest":"sha256:b7cfa261120083e3b1b9fd9ea491077753c3bbf9f0c62b9aceb0f7d1ed4c954d","observation_id":"ae7fae6c-47c1-418d-9b2e-0f7887b6fedc","resolution":{"observed_at":"2026-08-03T00:25:06.559706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2605.17467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.17467","snapshot_observed_at":"2026-08-15T21:11:42.215613Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","venue":"cs.CL","work_id":"75351c6b-eb84-4ad5-a8f7-dd2d2a2c826b","year":2026},"citing_paper":{"arxiv_id":"2608.12895","last_updated":"2026-08-13T07:25:05Z","snapshot_observed_at":"2026-08-18T21:02:31.897189Z","submitted_at":"2026-08-13T07:25:05Z","title":"Agent Behavioral Contracts II: Certifying Compositional Reliability Without Assuming Independence","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T21:11:42.030356Z"},"links":{"cited_paper":"/paper/2605.17467","citing_paper":"/paper/2608.12895"},"observation_digest":"sha256:b6a4bfb337c8d0f3305e9d228d1e905ca273f2213105bf455c1e7120d1dd0937","observation_id":"6d87de6c-8525-41f4-8553-b4df645464c5","resolution":{"observed_at":"2026-08-15T21:11:42.221403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.17467/citation-record","integrity":"/paper/2605.17467/integrity","json":"/paper/2605.17467/citation-record.json","paper":"/paper/2605.17467"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:b660a4db76c0da1f25ce2d42a5cb5d2e9468ef9c6db59808d1923fcfba9d1e8e","observation_id":"a66a28f9-8c8f-413a-9f82-1a9be409031e","resolution":{"observed_at":"2026-05-20T12:58:17.714684Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.00516","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:27:29.959136Z","title":"Advani, Trajectory guard – a lightweight, sequence-aware model for real-time anomaly detection in agentic AI, arXiv preprint arXiv:2601.00516 (2026)","venue":null,"work_id":"0be9a536-2564-4f13-82d5-0badcaf070ff","year":2026},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:f8e059747550ed1404aafec8fa4314025eba7e9ff3875cd4c269c9c051ee3dc1","observation_id":"46cfc95f-1c38-4efd-89ae-b944e9ec67a5","resolution":{"observed_at":"2026-05-20T12:58:17.691564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04886","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:17:10.161605Z","title":"Where did it all go wrong? a hierarchical look into multi-agent error attribution","venue":null,"work_id":"373d0cb9-c566-41e4-9880-ef2225cc9eaa","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:4a91abfcf17f0cc99594cf68e854599b6f0dea50d1757363b0ee62d6bd78c073","observation_id":"d35b6493-0fa6-40d8-bee6-760aaa9e0f68","resolution":{"observed_at":"2026-05-20T12:58:17.663409Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-08-16T06:37:17.259416Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:bec9571728cd38373b8b0ce8ac2be818b43e5ac58af3316e146099a01baf2bc7","observation_id":"cd817ec4-43ec-4f51-9782-a02f7c3ea265","resolution":{"observed_at":"2026-05-20T12:58:17.699454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:99352842cfa44331ab67bed36a1c8183695a425507452001a3da09e62ce0d212","observation_id":"b621e1c0-7fdc-4562-9515-9392607f9ad5","resolution":{"observed_at":"2026-05-20T12:58:17.727464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improv- ing factuality and reasoning in language models through multiagent debate","venue":null,"work_id":"746c3b24-ef11-45e7-88c2-7cb77281051e","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:9b33a0dd2627f5eabbf6c6478ce532d5c7f2dae065a2a33afb1fbd125ece6dbd","observation_id":"3abf56db-dd39-4cff-b607-6c90950c3aa1","resolution":{"observed_at":"2026-05-20T12:58:18.236298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:40:00.448056Z","title":"arXiv preprint arXiv:2509.13782 , year=","venue":null,"work_id":"307f45b1-f794-4c9a-aef9-96718064048d","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:f958776cb279242519f55e9c7885a2df9ea4003d9d99b9bb2b4b8380c9eb8b5f","observation_id":"16713f7c-eddf-4415-b861-f3363f5d3c9c","resolution":{"observed_at":"2026-05-20T12:58:17.723713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66b48cdd-523d-4f6e-a38b-137bbc8e2c6a","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:baf2cca40bc5320b59f2ab83d08ac2fc822e3c4676be8475f6b20fb961546ed3","observation_id":"6cb89088-f43d-4f8c-9e2d-44a003110ef3","resolution":{"observed_at":"2026-05-20T12:58:18.264577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms.Advances in neural information processing systems, 37:8093–8131","venue":null,"work_id":"5234dea1-843f-45d7-8a52-61aa687df1d4","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:6e1801b833de748de8680e253a83e67676a7d79d4146c88b858ce55fe9e90d7b","observation_id":"2ad33ce6-0e1a-4c25-b0de-9770526b5834","resolution":{"observed_at":"2026-05-20T12:58:18.234446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:a987fca372f199943faed2e61efb3a26cfe6ee29be80b929cbbcd9feaf8eb09c","observation_id":"7046a0b8-b99a-48e6-86ab-05a37cd927d1","resolution":{"observed_at":"2026-05-20T12:58:17.640135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.25001","doi":"10.48550/arxiv.2603.25001","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rethinking failure attribution in multi-agent systems: A multi-perspective benchmark and evaluation","venue":"arXiv (Cornell University)","work_id":"4adba693-6b50-41f7-9e56-8b8d68d82823","year":2026},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:dd635eab02f02af278c0cad229f54cf96349490cad01a3c64dc7c3f9dd985260","observation_id":"17df799c-4202-45f3-af95-dcdcc32af8f0","resolution":{"observed_at":"2026-05-20T12:58:17.686709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:7038f9e088395038601101b5a58b45330c27deaf1bfeb7e4f76e5748994c119a","observation_id":"972fa3de-becc-4faf-b95f-87572778f632","resolution":{"observed_at":"2026-05-20T12:58:17.649679Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.19843","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:19:56.812522Z","title":"Mas-fire: Fault injection and reliability evaluation for llm-based multi-agent systems.arXiv preprint arXiv:2602.19843","venue":null,"work_id":"cc0769dc-a88a-4fb5-a9a0-886ffb1669f9","year":2026},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:7b0e32123e0d726c0c4d6cb18753e7dd987c9a466e23a28eedcf7337225f0af6","observation_id":"c05273a1-8276-4694-bd52-f464b975b65b","resolution":{"observed_at":"2026-05-20T12:58:17.703277Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.14295","last_updated":"2026-04-27T01:35:16Z","snapshot_observed_at":"2026-08-01T22:51:54.312641Z","submitted_at":"2025-09-17T02:31:03Z","title":"Aegis: Automated Error Generation and Attribution for Multi-Agent Systems","version":6},"cited_work":{"arxiv_id":"2509.14295","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.14295","snapshot_observed_at":"2026-07-02T03:16:34.027226Z","title":"Aegis: Automated Error Generation and Attribution for Multi-Agent Systems","venue":"cs.RO","work_id":"ec78085d-727c-4f36-856c-67638afa8c92","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2509.14295","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:7f607dd2d9e749c441bfa3fac361ce66f0e9feaed9e92a34258eab1e5014998e","observation_id":"88ad6f04-fd13-4933-9b48-2e1259c3ac0f","resolution":{"observed_at":"2026-05-20T12:58:17.676496Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contractnli: A dataset for document-level natural language inference for contracts","venue":null,"work_id":"553468ea-0dc1-40be-83ce-d88c57b269ae","year":2021},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:9a1a1f3db6d4fc29232769ae5d579432632da3e0adbf56171b6eac60a2d96887","observation_id":"4c0bc9fc-b6a9-4314-9eed-3b49a9be4771","resolution":{"observed_at":"2026-05-20T12:58:18.260573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Slm as guardian: Pioneering ai safety with small language model","venue":null,"work_id":"c64545b1-05ec-410b-a7c0-aa5c3b32578a","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:73ff092289382b079712dd969903b0bc87fc3702fab54ef04748a5dcd9d26299","observation_id":"dff3a778-a9bc-4254-8d30-305a020d06e8","resolution":{"observed_at":"2026-05-20T12:58:18.262510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18491","last_updated":"2026-04-23T11:55:10Z","snapshot_observed_at":"2026-07-06T22:43:02.453697Z","submitted_at":"2026-01-26T13:45:41Z","title":"AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security","version":2},"cited_work":{"arxiv_id":"2601.18491","doi":"10.48550/arxiv.2601.18491","metadata_source":"pith","pith_arxiv_id":"2601.18491","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security","venue":"cs.AI","work_id":"88a6b07a-a4ce-47cd-baf1-0b04263ae074","year":2026},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2601.18491","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:5ba1b3e2d86c82b12d75c124a0fd84a5af41cf9277496f1faeb1d92bcf54df9b","observation_id":"6636dfbc-2a7d-4d16-88fe-636d930ee506","resolution":{"observed_at":"2026-05-20T12:58:17.695469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.07509","last_updated":"2026-05-14T05:20:24Z","snapshot_observed_at":"2026-08-13T09:13:47.151346Z","submitted_at":"2026-05-08T09:40:53Z","title":"MASPrism: Lightweight Failure Attribution for Multi-Agent Systems Using Prefill-Stage Signals","version":2},"cited_work":{"arxiv_id":"2605.07509","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.07509","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MASPrism: Lightweight Failure Attribution for Multi-Agent Systems Using Prefill-Stage Signals","venue":"cs.SE","work_id":"918e9e97-61c1-4b5b-bb57-f5dc79fa15ba","year":2026},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2605.07509","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:8b97fd16cb1848a98f9b5cf80109ef7698434dae7e510b130b0df415ce6bb794","observation_id":"f6f32d16-432b-4279-98f5-d73220035e79","resolution":{"observed_at":"2026-05-20T12:58:17.681267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.18733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:28:18.857780Z","title":"Explainable and fine-grained safeguarding of llm multi-agent systems via bi-level graph anomaly detection","venue":null,"work_id":"7ae477e2-694e-40b5-a5f0-c75cf9797d04","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:df2130aeb6cb6ed4286a790d037936be156be2ca13d2995ca2a0a5cdec400d04","observation_id":"1ca703d0-fa19-46f3-8ae7-8856b4441cef","resolution":{"observed_at":"2026-05-20T12:58:17.731694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.04032","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:25:02.469521Z","title":"Pathak, H","venue":null,"work_id":"4a1479de-8588-409f-b638-8774063c9d7d","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:b52d0ebf123a982efbd4abe84a2603227670acc9c9966792e45b438e537fb5bc","observation_id":"6ad536fa-9dd7-4afb-98c0-d439195567d6","resolution":{"observed_at":"2026-05-20T12:58:17.659835Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep graph anomaly detection: A survey and new perspectives.IEEE Transactions on Knowledge and Data Engineering","venue":null,"work_id":"efa25f99-4500-4600-8668-14f9bcbfc725","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:63ca6b24c0d57363a73f08d06049526f7cc9d02c79ceb8513971c2dc45ebe358","observation_id":"d59730c9-091b-46de-887c-ae0187476458","resolution":{"observed_at":"2026-05-20T12:58:18.238172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"d5f9fd7b-a12b-47c3-9e5e-2f761271c187","year":null},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:c9c08cc69016b0bac74cd5f1811288a769802d3960ca0cd13eefde34ab1a2699","observation_id":"6050a654-dc83-409c-b9a8-667bec4e0a64","resolution":{"observed_at":"2026-05-20T12:58:18.258378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen3 technical report","venue":null,"work_id":"7a1d9b9a-f71c-49e4-853a-218fdc87628f","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:59f53ec79bc5d75a525a2fa13742d9047c3905e38bc8a08696c092e710a3fc6a","observation_id":"49aefb52-94a8-48b8-8350-f65c2acdbb24","resolution":{"observed_at":"2026-05-20T12:58:18.255883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models don’t always say what they think: Unfaithful explanations in chain-of-thought prompting.Advances in Neural Information Processing Systems, 36:74952–74965","venue":null,"work_id":"d69409d6-9c47-45d6-a954-37aad24adc49","year":2023},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:a54f294a01d773cb0d8d13f959d3ab2d34f071372cfffb95a17976bfdf7efb60","observation_id":"82ff1cc6-df17-48a5-9c48-cc013c06305c","resolution":{"observed_at":"2026-05-20T12:58:18.252091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Saferdialogues: Taking feedback gracefully after conversational safety failures","venue":null,"work_id":"5717d3f4-ac13-4a6b-bb78-9ceec2e4013c","year":2022},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:cb19593c8c3d5724de6e80fdcb0242f279d3f228bb0c2c81d8adb37c06f91a3a","observation_id":"7ce76036-62eb-4f41-bc39-6fef4b4f8b19","resolution":{"observed_at":"2026-05-20T12:58:18.254017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"G-safeguard: A topology-guided security lens and treatment on llm- based multi-agent systems","venue":null,"work_id":"e58d662f-dbe4-4da7-bfe9-be9d5da5fed1","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:91af3e27406e27e4b8116ee024b58e0bcf7f8a378bd613c28177302ccdd8148b","observation_id":"9cf5e510-6dd0-4748-9423-6321b4dd6352","resolution":{"observed_at":"2026-05-20T12:58:18.248174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guardagent: Safeguard llm agents via knowledge-enabled reasoning","venue":null,"work_id":"0adef01e-b044-4335-90ca-d37367ff7cbc","year":null},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:986c1641c16099c5c0f6dec18b0a8df7da39589f08bbdc89b3a28dfda32f04f3","observation_id":"418c2c75-1c7e-462a-bf12-016df9170044","resolution":{"observed_at":"2026-05-20T12:58:18.246183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:61c7c22a2001428525d12f9787e65bb6340b45f001e9edb0cc55af3ae7fc8759","observation_id":"c542d1c4-3bda-461e-82c0-ae0851ad711b","resolution":{"observed_at":"2026-05-20T12:58:17.646746Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-08-19T02:59:43.798238Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":"2407.21772","doi":"10.48550/arxiv.2407.21772","metadata_source":"pith","pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","venue":"cs.CL","work_id":"6d0d9d39-490d-48d5-b346-6bfe40b8b8fb","year":2024},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:870f1a967ad6ddd3ae0a63c507862352c5bd5941afeb57cbc0879d2aba90d1e5","observation_id":"54c479ef-2d88-4c70-a759-921692385558","resolution":{"observed_at":"2026-05-20T13:17:39.551920Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03312","last_updated":"2025-09-04T17:49:20Z","snapshot_observed_at":"2026-08-18T15:05:38.182018Z","submitted_at":"2025-09-03T13:42:14Z","title":"AgenTracer: Who Is Inducing Failure in the LLM Agentic Systems?","version":2},"cited_work":{"arxiv_id":"2509.03312","doi":"10.48550/arxiv.2509.03312","metadata_source":"pith","pith_arxiv_id":"2509.03312","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zhang, J","venue":"cs.CL","work_id":"bcc7b37c-db67-4d9b-8cc2-9458cc338abd","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2509.03312","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:4fe60d46ed74c95e1e345929d347f074e0d634a9fe877245c5d199d52cee648e","observation_id":"511f8513-bdee-42ed-9607-b809d9b600ef","resolution":{"observed_at":"2026-05-20T12:58:17.707074Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:55.524505+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:55.524505+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"G-designer: Architecting multi-agent communication 11 topologies via graph neural networks","venue":null,"work_id":"a30fcdcb-de6e-47d1-822b-656ea8c595cb","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:ead6206764b0c70709926879fce7735b381f27b7946beb42b415c91eb6e99f01","observation_id":"f5eb13a8-0416-410c-91bc-0e67f88e1b64","resolution":{"observed_at":"2026-05-20T12:58:18.250019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.10581","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T06:07:41.527672Z","title":"Graphtracer: Graph-guided failure tracing in llm agents for robust multi-turn deep search","venue":null,"work_id":"21923da2-c72d-4c26-aa58-16118b67ccf2","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:0c72edc7d5b9a4b5e8c51aaf7e47a9160ceb0f212af065636c9f2771c66ad5ae","observation_id":"f7d126be-6a93-470f-9898-673ffb358b33","resolution":{"observed_at":"2026-05-20T12:58:17.711516Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Which agent causes task failures and when? on automated failure attribution of LLM multi-agent systems","venue":null,"work_id":"3980739f-3222-4716-8795-0c29280fa34e","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:5e39c079da0836a3523afd63b30568af812804af85491b17fcf1e241939fbc85","observation_id":"49530b9a-f2e0-4b7e-ad1e-4c5ae4685484","resolution":{"observed_at":"2026-05-20T12:58:18.241935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Re- thinking the reliability of multi-agent system: A perspective from byzantine fault tolerance","venue":null,"work_id":"b3f88e17-5e7a-4ebe-81d4-440458f2cad2","year":null},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:3a36578852741cffaadf9e0efccc70267ccfcda9bc85f62ddac32e5939ea54c8","observation_id":"4b65a484-6b4b-4e20-8a1d-e7193e5bafdf","resolution":{"observed_at":"2026-05-20T12:58:18.243877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19234","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:39:46.492256Z","title":"Guardian: Safeguarding llm multi-agent collabora- tions with temporal graph modeling","venue":null,"work_id":"daee751c-6693-49e4-8131-5cdd46f9a284","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:53b5d47b8e5863b2f172da029ee6431b0a4b3c113a5c641c8c760ba0345e6209","observation_id":"69a201ba-5502-411c-a80d-a399982695c4","resolution":{"observed_at":"2026-05-20T12:58:17.653002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.25370","doi":"10.48550/arxiv.2509.25370","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"verbose database queries correlate with null results","venue":"arXiv (Cornell University)","work_id":"f5d9bb38-d94c-48e1-81b3-06c3398e72d1","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:fd6ea3c24a552737213d5d1fe7992b6dc8cc328d5e30ab401fb34b1bf2261c00","observation_id":"f29ed659-61b5-4d5c-8007-d344914fa113","resolution":{"observed_at":"2026-05-20T12:58:17.718757Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:55.99496+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:55.99496+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agent-as-a-judge: Evaluate agents with agents","venue":null,"work_id":"d07060ff-45cb-476f-9096-db4233b18f89","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:d9189333979ab1084144ef36f585d040e2817a840331f8663669900ec7120fd1","observation_id":"1a1a34b6-5288-440e-b174-d64c1658b4f9","resolution":{"observed_at":"2026-05-20T12:58:18.239958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.20639","last_updated":"2026-08-03T15:58:02Z","snapshot_observed_at":"2026-08-19T21:15:00.801476Z","submitted_at":"2025-11-25T18:56:57Z","title":"Latent Collaboration in Multi-Agent Systems","version":4},"cited_work":{"arxiv_id":"2511.20639","doi":"10.48550/arxiv.2511.20639","metadata_source":"pith","pith_arxiv_id":"2511.20639","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2511.20639 , year=","venue":"cs.CL","work_id":"0ae29ba2-3e94-41be-b6e9-71cf059f885b","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2511.20639","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:fe745100925007fac7b9747dc6fde874e64e93dd30d94d537a9d3c9ee14ce45c","observation_id":"21c7b0e7-c9c5-42bf-8b4b-c8c0b2f56a66","resolution":{"observed_at":"2026-06-02T03:04:02.535394Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T16:14:15.853642Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":18,"verified_fuzzy":15},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 2 inbound Pith citation observations for arXiv:2605.17467."}