{"as_of":"2026-08-09T13:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75b1a56f3f217fbb282b14fa621f13dcf5cef40733ebb1c563d325fc0f1f8655","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:56:36.558074Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T03:27:35.774566Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2504.19678","last_updated":"2026-03-06T19:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-28T11:08:22Z","title":"From LLM Reasoning to Autonomous AI Agents: A Comprehensive Review","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-15T02:57:37.873567Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2504.19678"},"observation_digest":"sha256:b646d592d8022946f55973f20e2ffc37b4c516c67b8d2d559062c0381f53f9b7","observation_id":"a61c6093-c986-49db-9947-37c7a3aeb1ab","resolution":{"observed_at":"2026-05-15T02:57:38.357124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-07T14:56:36.558074Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16979","last_updated":"2025-05-22T17:52:33Z","snapshot_observed_at":"2026-08-07T14:49:56.579072Z","submitted_at":"2025-05-22T17:52:33Z","title":"Know the Ropes: A Heuristic Strategy for LLM-based Multi-Agent System Design","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:56:36.558074Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2505.16979"},"observation_digest":"sha256:8b2daa9d217fec8beaa986c02ad6700332a6ddf1e17adb87186c64a02674b494","observation_id":"27510b94-8cf9-4669-8915-68833004d2e4","resolution":{"observed_at":"2026-08-07T14:56:36.558074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-07T11:14:47.480547Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03053","last_updated":"2025-07-10T14:54:28Z","snapshot_observed_at":"2026-08-09T07:39:01.888414Z","submitted_at":"2025-06-03T16:33:47Z","title":"MAEBE: Multi-Agent Emergent Behavior Framework","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:14:47.480547Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2506.03053"},"observation_digest":"sha256:542f70090a97efe1bccf95e9d0c6a43858626253cc2453315e75666413467c7c","observation_id":"5f9e543e-bfbe-4e9e-87ff-8f1bac9195ca","resolution":{"observed_at":"2026-08-07T11:14:47.480547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T07:52:17.174347Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2506.07982"},"observation_digest":"sha256:3faebec9a12cd4e24bcc94c269561563b9522e29c41a51b52115da72016163e7","observation_id":"c0b45b05-2cb2-4c42-a962-c81f9586c150","resolution":{"observed_at":"2026-05-12T07:52:17.420035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-07T06:00:19.713862Z","title":"Evaluating the collaboration and competition of llm agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11102","last_updated":"2025-06-06T17:52:18Z","snapshot_observed_at":"2026-08-07T05:54:56.593167Z","submitted_at":"2025-06-06T17:52:18Z","title":"Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey","version":1},"reference_index":153,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:19.713862Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2506.11102"},"observation_digest":"sha256:297635eaf6f02562758e577c52cb58fa224327f24d7ec9794671396e8d76f45d","observation_id":"0c3d80f2-62f4-4044-bb31-68a94500eb03","resolution":{"observed_at":"2026-08-07T06:00:19.713862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-06T17:42:59.020753Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents.arXiv preprint arXiv:2503.01935, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.10142","last_updated":"2026-07-22T04:23:01Z","snapshot_observed_at":"2026-08-07T20:29:46.771527Z","submitted_at":"2025-07-14T10:39:17Z","title":"Toward Adaptable Multi-Agent Reinforcement Learning: An Assumption-Aware Review","version":2},"reference_index":161,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:59.020753Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.10142"},"observation_digest":"sha256:fc45a57b6a0901c9d7d98e5b4f9b1c51676b6dacb4747adee7e573d1b89006d0","observation_id":"1b7069b3-c9b9-4bfe-aff9-bdfb63238d12","resolution":{"observed_at":"2026-08-06T17:42:59.020753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-06T14:57:06.663765Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents.arXiv preprint arXiv:2503.01935, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17257","last_updated":"2025-07-23T06:56:15Z","snapshot_observed_at":"2026-08-06T18:04:24.113657Z","submitted_at":"2025-07-23T06:56:15Z","title":"Agent Identity Evals: Measuring Agentic Identity","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:57:06.663765Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.17257"},"observation_digest":"sha256:5ecb5500583516963270d37f53021bbcbb35516a30c1ce000690676f5b1c9ca5","observation_id":"d02d8bf0-e065-4fe5-8a9a-ad4782b7ba78","resolution":{"observed_at":"2026-08-06T14:57:06.663765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2507.21046","last_updated":"2026-01-16T20:59:08Z","snapshot_observed_at":"2026-08-01T06:32:44.461162Z","submitted_at":"2025-07-28T17:59:05Z","title":"A Survey of Self-Evolving Agents: What, When, How, and Where to Evolve on the Path to Artificial Super Intelligence","version":4},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-14T22:23:14.621091Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.21046"},"observation_digest":"sha256:d6e4d6ce245b0744f59ad3471e81e3fcc30972b83eb4597c059467f042af43d5","observation_id":"c99c668f-8563-40b6-b67b-6700452afdfd","resolution":{"observed_at":"2026-05-14T22:23:15.694169Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-06T12:09:26.597705Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22034","last_updated":"2025-07-29T17:34:12Z","snapshot_observed_at":"2026-08-07T20:29:47.386254Z","submitted_at":"2025-07-29T17:34:12Z","title":"UserBench: An Interactive Gym Environment for User-Centric Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T12:09:26.597705Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2507.22034"},"observation_digest":"sha256:81ef0f504df78a9b775d7520aef451851726fd573cd1c6cf4808fb570a24dce9","observation_id":"8170dce8-26b6-470c-ac13-5f6f89c498e4","resolution":{"observed_at":"2026-08-06T12:09:26.597705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:a6d8c567f75931117ee9855f0a8bb57b67fecd29d6ec7c27f15d67f489132f23","observation_id":"bfef6379-2f38-4db2-b083-513148057539","resolution":{"observed_at":"2026-05-14T23:13:15.314704Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2601.12538","last_updated":"2026-01-18T18:58:23Z","snapshot_observed_at":"2026-08-04T22:42:23.171653Z","submitted_at":"2026-01-18T18:58:23Z","title":"Agentic Reasoning for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-17T15:14:25.558878Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2601.12538"},"observation_digest":"sha256:dca559e5ca37c0cc1fbaa1c72012c9945ccc7475e8a2f1ae0cb77ebc7792f96c","observation_id":"8d35b3e5-4ab4-4ab1-a102-a5fa0cdcab1c","resolution":{"observed_at":"2026-05-17T15:14:25.748174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-02T23:58:48.504758Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12089","last_updated":"2026-06-27T04:49:42Z","snapshot_observed_at":"2026-08-07T01:50:59.966280Z","submitted_at":"2026-02-12T15:41:57Z","title":"Choose Your Agent: Tradeoffs in Adopting AI Advisors, Coaches, and Delegates in Multi-Party Negotiation","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T23:58:48.504758Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2602.12089"},"observation_digest":"sha256:c4bbcc261c296d7d942197f9f78798f83407afc63e914aabea0d300a5727ec59","observation_id":"18a3958e-d235-45ee-9b01-d126a6916f3e","resolution":{"observed_at":"2026-08-02T23:58:48.504758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-14T21:00:05.911327Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.14771","last_updated":"2026-05-31T08:16:27Z","snapshot_observed_at":"2026-08-07T17:32:45.832131Z","submitted_at":"2026-03-16T03:12:18Z","title":"OpenHospital: A Thing-in-itself Arena for Evolving and Benchmarking LLM-based Collective Intelligence","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T21:00:05.911327Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2603.14771"},"observation_digest":"sha256:bf8bc7392094f63010b800e97ded6f39cb7e53dea5f00cae482ba96c9b6b67e4","observation_id":"d15010e0-8901-4f6b-8194-cf257e3f1519","resolution":{"observed_at":"2026-07-14T21:00:05.911327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-13T15:55:53.399860Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.29139","last_updated":"2026-07-16T18:43:17Z","snapshot_observed_at":"2026-08-07T05:26:14.949741Z","submitted_at":"2026-03-31T01:41:28Z","title":"SciVisAgentBench: A Benchmark for Evaluating Scientific Data Analysis and Visualization Agents","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-13T15:55:53.399860Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2603.29139"},"observation_digest":"sha256:405ae905c05fa3619e63151245f0f3a91c2d9374753372940fae3bb122f46ef4","observation_id":"2881e264-9ac3-46c6-abf5-762bfc09a607","resolution":{"observed_at":"2026-07-13T15:55:53.399860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-02T17:09:18.216490Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.29139","last_updated":"2026-07-16T18:43:17Z","snapshot_observed_at":"2026-08-07T05:26:14.949741Z","submitted_at":"2026-03-31T01:41:28Z","title":"SciVisAgentBench: A Benchmark for Evaluating Scientific Data Analysis and Visualization Agents","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-02T17:09:18.216490Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2603.29139"},"observation_digest":"sha256:7634e927a9d16b0df6d33b7f1abfcc743af2868d93dc9acfccedf9f42a8bcf8a","observation_id":"fbcb25a6-0a15-4e04-9a92-5f7ab06450ae","resolution":{"observed_at":"2026-08-02T17:09:18.216490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2604.01487","last_updated":"2026-04-06T08:32:52Z","snapshot_observed_at":"2026-07-06T22:51:35.522923Z","submitted_at":"2026-04-01T23:43:23Z","title":"AgentSocialBench: Evaluating Privacy Risks in Human-Centered Agentic Social Networks","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-13T21:50:20.721358Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2604.01487"},"observation_digest":"sha256:55a330d71544ecc932cc513ace51da355a734b6b5669112d18ae92760da7cf33","observation_id":"c0955dcc-c49e-4551-abb5-d0876c56fec9","resolution":{"observed_at":"2026-05-13T21:53:19.908180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2604.18805","last_updated":"2026-04-20T20:23:42Z","snapshot_observed_at":"2026-08-02T09:17:21.557888Z","submitted_at":"2026-04-20T20:23:42Z","title":"AI scientists produce results without reasoning scientifically","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T03:56:34.581133Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2604.18805"},"observation_digest":"sha256:8d3f6860f70659cc55657d271161550a0136041440b4df9aceeb61d6549e549c","observation_id":"252e6b62-495a-41a3-9e60-04fd99f068d2","resolution":{"observed_at":"2026-05-11T12:16:06.904354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2605.07073","last_updated":"2026-05-08T00:48:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T00:48:45Z","title":"TeamBench: Evaluating Agent Coordination under Enforced Role Separation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T00:55:51.358828Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2605.07073"},"observation_digest":"sha256:0bcead67769c99ac21507033ed850c9535d599499fb032cbfd538f76fb79330a","observation_id":"bfe52e0a-8231-4ace-9ecf-4359059f2713","resolution":{"observed_at":"2026-05-11T05:00:55.521476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2605.07935","last_updated":"2026-05-08T16:05:31Z","snapshot_observed_at":"2026-08-03T01:09:10.584822Z","submitted_at":"2026-05-08T16:05:31Z","title":"TraceFix: Repairing Agent Coordination Protocols with TLA+ Counterexamples","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T03:27:03.589336Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2605.07935"},"observation_digest":"sha256:5c30384e161f5f6e1d4bc86f21cb29f505515c056a140fbbc9537b98c1070c6c","observation_id":"7372c09c-75cc-441f-be0a-3fb26c719e42","resolution":{"observed_at":"2026-05-11T03:30:55.920340Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2605.08761","last_updated":"2026-05-09T07:47:07Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T07:47:07Z","title":"Beyond the All-in-One Agent: Benchmarking Role-Specialized Multi-Agent Collaboration in Enterprise Workflows","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T03:41:40.370052Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2605.08761"},"observation_digest":"sha256:451499196faac582eff4b44adc5a0dd854d90b7f4757d93e7c11196fada45263","observation_id":"00aa1280-cc3c-445d-840c-a5a1a8a3157b","resolution":{"observed_at":"2026-05-12T07:06:37.855701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2605.28655","last_updated":"2026-05-27T15:56:12Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T15:56:12Z","title":"AutoScientists: Self-Organizing Agent Teams for Long-Running Scientific Experimentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-29T12:39:00.460842Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2605.28655"},"observation_digest":"sha256:322443143ae7e9a88b6588ceb882909f4e3052cb16a43207455ac66ce412cd34","observation_id":"10c0f2f7-b6ee-4420-803c-3172a489afa9","resolution":{"observed_at":"2026-06-29T12:43:25.733658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2606.09800","last_updated":"2026-06-08T17:53:05Z","snapshot_observed_at":"2026-08-04T17:34:24.654745Z","submitted_at":"2026-06-08T17:53:05Z","title":"FASE: Fast Adaptive Semantic Entropy for Code Quality","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T15:18:44.055533Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2606.09800"},"observation_digest":"sha256:f16485f84d98a095be7c7fa805a9a10f46519c0ff3777f30b36597f6b38c279b","observation_id":"7773379c-34cc-48ac-8804-23ed0c0d0fca","resolution":{"observed_at":"2026-07-03T03:27:35.776192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2606.20629","last_updated":"2026-05-28T17:12:20Z","snapshot_observed_at":"2026-08-07T14:37:18.602432Z","submitted_at":"2026-05-28T17:12:20Z","title":"Specialize Roles, Mix Deployments: Pushing the Cost-Accuracy Frontier of LLM Agent Teams","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T23:53:23.807636Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2606.20629"},"observation_digest":"sha256:496586c967aeebb6a3245ee6b2a8dc8e8a710e713bfed2c410a198ccfe41e55e","observation_id":"50ca8191-5879-40c2-9331-230a41baadee","resolution":{"observed_at":"2026-06-29T00:02:50.061568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2606.28425","last_updated":"2026-06-25T19:42:39Z","snapshot_observed_at":"2026-08-02T13:33:32.015808Z","submitted_at":"2026-06-25T19:42:39Z","title":"Tool Use Enables Undetectable Steganography in Multi-Agent LLM Systems","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-30T00:42:20.220668Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2606.28425"},"observation_digest":"sha256:74f00ef41eaec94a89aa55fef477d781b0b91f80fe5e1d3f0a15f934bc5af7ea","observation_id":"a7326bcc-83b5-4437-9451-6f157cfe7998","resolution":{"observed_at":"2026-07-01T16:25:49.951375Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":"2503.01935","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-03T03:27:35.774566Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":"ff7537a6-4988-47a2-b36f-5cacae7582ae","year":2025},"citing_paper":{"arxiv_id":"2606.30546","last_updated":"2026-06-29T16:46:28Z","snapshot_observed_at":"2026-08-04T14:29:28.834781Z","submitted_at":"2026-06-29T16:46:28Z","title":"MAS-Lab: A Specification-Driven Validation Framework for Reliable Multi-Agent Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T03:14:38.619889Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2606.30546"},"observation_digest":"sha256:ffb5190b4b99c49ae6dfebd426a477021d99c85e203c4de2c7a169f3d6422367","observation_id":"4fceb272-b46e-48c0-829e-7c6da2ea20d3","resolution":{"observed_at":"2026-06-30T03:24:12.544089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-02T04:28:31.310957Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents.arXiv preprint arXiv:2503.01935, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13705","last_updated":"2026-07-15T11:11:17Z","snapshot_observed_at":"2026-08-03T20:43:07.752913Z","submitted_at":"2026-07-15T11:11:17Z","title":"AgentCompass: A Unified Evaluation Infrastructure for Agent Capabilities","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T04:28:31.310957Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2607.13705"},"observation_digest":"sha256:ab0ae521a41c747cd8b032f98274ed33d0d7bfa668cf2d79b61ec51add3a9a2c","observation_id":"a261d788-53f4-44ef-8fe5-4c0af4caab2d","resolution":{"observed_at":"2026-08-02T04:28:31.310957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-07-31T23:11:43.198650Z","title":"arXiv preprint arXiv:2503.01935 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24063","last_updated":"2026-07-29T12:23:50Z","snapshot_observed_at":"2026-08-09T00:52:07.812312Z","submitted_at":"2026-07-27T07:05:11Z","title":"The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Static Leaderboards","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-31T23:11:43.198650Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2607.24063"},"observation_digest":"sha256:c41bbfea6b913851b6f6670dcaff9215ccf5bc5f055e12ae34bdeafb9940e6fd","observation_id":"ff51b4c0-9728-4b8b-a89c-5779826742ec","resolution":{"observed_at":"2026-07-31T23:11:43.198650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01935","snapshot_observed_at":"2026-08-05T15:25:39.435557Z","title":"doi:10.48550/arXiv.2503.01935 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-08T18:58:23.959751Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:39.435557Z"},"links":{"cited_paper":"/paper/2503.01935","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:64ae03b8eead0076d720c1749312a8a328ad3c70f30cd40abbae525f872b3708","observation_id":"d9d2bbf0-6bf3-475e-99a6-2a48752b9d5b","resolution":{"observed_at":"2026-08-05T15:25:39.435557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.01935/citation-record","integrity":"/paper/2503.01935/integrity","json":"/paper/2503.01935/citation-record.json","paper":"/paper/2503.01935"},"outbound":[],"paper":{"arxiv_id":"2503.01935","last_updated":"2025-03-03T05:18:50Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T17:34:49.570629Z","submitted_at":"2025-03-03T05:18:50Z","title":"MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2503.01935."}