{"as_of":"2026-08-06T18:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55cbfb97578e87554ddb58c70525ced57531cedb30b81f0adb8a867cad58cf9e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:55:44.720516Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T13:05:26.667750Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2512.02556"},"observation_digest":"sha256:ca67e831e4178189338f49bc58382b2a3226c93c4ba0cf80c63c70e3d0994ae0","observation_id":"69125550-6611-4428-b14e-e6d3a9f12807","resolution":{"observed_at":"2026-05-10T13:05:26.757169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T08:28:16.904091Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:a68b4138313e66c79029b0d0778d69bc40eb84ca759ea40151fd5c04d7626ab4","observation_id":"9d92ba12-d334-4ef6-82be-45e464a741d0","resolution":{"observed_at":"2026-05-16T08:30:45.635713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T15:10:04.253250Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:afe9b0cc79c1c8f5c8e4d8770acf2541b33862f2e132ad8e012dcbbbff7e7e82","observation_id":"dfa94d0d-b9c8-43b9-ae2d-edaf6eb15fa6","resolution":{"observed_at":"2026-05-21T15:10:16.406044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-03T01:21:07.423753Z","title":"ISBN 979-8-89176-195-7","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.10090","last_updated":"2026-05-22T21:39:46Z","snapshot_observed_at":"2026-08-03T01:21:05.435139Z","submitted_at":"2026-02-10T18:55:41Z","title":"Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T01:21:07.423753Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2602.10090"},"observation_digest":"sha256:2252e3bcca19e060a85cd7f653765c00f6f0c9bca768efac90f7768da9274958","observation_id":"593d568d-b3df-4616-9c2b-7c9f65680ce3","resolution":{"observed_at":"2026-08-03T01:21:07.423753Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2602.11224","last_updated":"2026-04-28T16:08:25Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T13:31:18Z","title":"Agent-Diff: Benchmarking LLM Agents on Enterprise API Tasks via Code Execution with State-Diff-Based Evaluation","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T03:04:17.755968Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2602.11224"},"observation_digest":"sha256:9ebffe7d9cd7d0ce74028292a6f12aea51d7bedc056bff6715a8ebbb0655bbfb","observation_id":"ce949294-6236-4f31-a63f-0081bf149ec0","resolution":{"observed_at":"2026-05-16T03:07:11.521829Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-02T23:04:32.736348Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14878","last_updated":"2026-05-31T05:10:10Z","snapshot_observed_at":"2026-08-02T23:04:25.658810Z","submitted_at":"2026-02-16T16:10:11Z","title":"Model Context Protocol (MCP) Tool Descriptions Are Smelly! Towards Improving AI Agent Efficiency with Augmented MCP Tool Descriptions","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T23:04:32.736348Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2602.14878"},"observation_digest":"sha256:8fb399bba6ef13a4ad60a0909227d0cf021ee59aa83f0e50c7d5c513e0067cd6","observation_id":"8e779399-18b9-4c3a-9840-75d953e16790","resolution":{"observed_at":"2026-08-02T23:04:32.736348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-04T05:55:44.720516Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.05637","last_updated":"2026-08-03T15:19:02Z","snapshot_observed_at":"2026-08-06T18:35:58.497706Z","submitted_at":"2026-03-05T19:47:26Z","title":"Real Faults in Model Context Protocol (MCP) Software: a Comprehensive Taxonomy","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-04T05:55:44.720516Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2603.05637"},"observation_digest":"sha256:3fd9682ab9bcfbfbd8b1dcb98facc02fcb344f476e9c2e9b5bb1a1a35c64e151","observation_id":"22552c04-e76f-4e2f-8c91-db610cfafe7e","resolution":{"observed_at":"2026-08-04T05:55:44.720516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2604.01532","last_updated":"2026-05-08T22:05:26Z","snapshot_observed_at":"2026-08-03T04:25:49.405977Z","submitted_at":"2026-04-02T02:09:27Z","title":"PHMForge: Evaluating LLM Agents on Industrial Prognostics through MCP-Native, Algorithm-Grounded Tools","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T22:05:25.133535Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2604.01532"},"observation_digest":"sha256:7c4c7952fa5f1cf6a4fad0aa5df5ab421713cfa93e4475e96e17a2ac81cee970","observation_id":"a6a86117-703e-4b9c-8590-b5f47a97040b","resolution":{"observed_at":"2026-05-13T22:08:20.734278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2604.04820","last_updated":"2026-04-06T16:24:07Z","snapshot_observed_at":"2026-07-06T22:53:41.734429Z","submitted_at":"2026-04-06T16:24:07Z","title":"ANX: Protocol-First Design for AI Agent Interaction with a Supporting 3EX Decoupled Architecture","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T18:42:40.250417Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2604.04820"},"observation_digest":"sha256:f2f9ecca88e3003f29145d18f4d0390a9f0cf9520e6a51d2f4d29a5b3a7df21d","observation_id":"2e7f9f2f-92a2-47ba-8be8-9724141b9a85","resolution":{"observed_at":"2026-05-11T00:05:49.940609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2604.17234","last_updated":"2026-04-19T03:38:10Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:38:10Z","title":"From Language to Action: Enhancing LLM Task Efficiency with Task-Aware MCP Server Recommendation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-10T06:20:49.799989Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2604.17234"},"observation_digest":"sha256:452acf19e0dcba20c5952987bb4385fc0cca16300ff5cb2943ebc0880e3bbdac","observation_id":"e42fd763-d473-4809-ba00-dbce8ed4a7b7","resolution":{"observed_at":"2026-05-10T06:21:26.755658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2604.18292","last_updated":"2026-04-20T14:01:10Z","snapshot_observed_at":"2026-07-06T23:05:13.178333Z","submitted_at":"2026-04-20T14:01:10Z","title":"Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-10T05:24:00.503836Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2604.18292"},"observation_digest":"sha256:ea0b2625e65d7ae95fbc64c39975c79a23dc6989748f9d30eacdbf3d4073274e","observation_id":"21447ab9-9ac1-43d2-b5e5-bbb40ea66f89","resolution":{"observed_at":"2026-05-10T05:25:54.737759Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2604.20714","last_updated":"2026-04-22T16:00:46Z","snapshot_observed_at":"2026-07-06T23:07:25.185196Z","submitted_at":"2026-04-22T16:00:46Z","title":"Learning to Evolve: A Self-Improving Framework for Multi-Agent Systems via Textual Parameter Graph Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-09T23:42:00.548132Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2604.20714"},"observation_digest":"sha256:29d7af768ab801f8636bebbd6da57abbf2c780dea799c981e94e9757f60ea1c7","observation_id":"655a4ae8-3cce-4af4-8345-63cbf2fcafaa","resolution":{"observed_at":"2026-05-11T14:01:07.105970Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2605.09131","last_updated":"2026-05-09T19:25:56Z","snapshot_observed_at":"2026-07-06T23:21:16.454273Z","submitted_at":"2026-05-09T19:25:56Z","title":"MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T02:11:05.857658Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2605.09131"},"observation_digest":"sha256:10d39d245ffd9ec55008f0b835c2da8570401a215a32bd8fa7c4c1191ae0f789","observation_id":"1d10706c-2cf3-4669-9e20-90ea824c2b23","resolution":{"observed_at":"2026-05-12T02:11:15.317013Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2605.13880","last_updated":"2026-05-11T04:34:43Z","snapshot_observed_at":"2026-07-06T23:25:25.361350Z","submitted_at":"2026-05-11T04:34:43Z","title":"PREPING: Building Agent Memory without Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T06:14:14.385586Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2605.13880"},"observation_digest":"sha256:5867074d9046dfae5bdc402e4fa6a26789025e50a377d57e2319bac2acb44840","observation_id":"71709c90-878f-40d4-b904-428615cab0ec","resolution":{"observed_at":"2026-05-15T06:15:06.160195Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2605.15104","last_updated":"2026-05-20T10:20:54Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:22:42Z","title":"From Text to Voice: A Reproducible and Verifiable Framework for Evaluating Tool Calling LLM Agents","version":2},"reference_index":271,"source":"arxiv_source","source_observed_at":"2026-05-21T08:45:56.550821Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2605.15104"},"observation_digest":"sha256:09dc4aeada02ef4d748391504e6c5e698d7b0d162e6891030fb4ada82b097321","observation_id":"a3ed0ffe-3c32-4572-9ab3-7a7969a97fe5","resolution":{"observed_at":"2026-05-21T08:49:53.738775Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2605.16909","last_updated":"2026-05-16T09:49:25Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T09:49:25Z","title":"TOBench: A Task-Oriented Omni-Modal Benchmark for Real-World Tool-Using Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T20:43:16.364125Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2605.16909"},"observation_digest":"sha256:b1ff7bfea40a9dcb5756a16969a505d7d973615358c2b8e28dcaa68105576dcd","observation_id":"59c9c8a8-3d89-4314-a560-1749b756683e","resolution":{"observed_at":"2026-05-19T20:47:45.985164Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2605.29676","last_updated":"2026-06-17T13:13:19Z","snapshot_observed_at":"2026-08-03T09:55:41.492535Z","submitted_at":"2026-05-28T09:38:13Z","title":"Notation Matters: A Benchmark Study of Token-Optimized Formats in Agentic AI Systems","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T07:13:03.046209Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2605.29676"},"observation_digest":"sha256:51a46de572e4063f803dc7d14d56df12cbf8de3a04a778ebb9ecef5d7bcff988","observation_id":"09363262-59e4-48f3-8ff4-47c02fbe7bcf","resolution":{"observed_at":"2026-06-29T07:13:16.038067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":135,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:a54322137b23870ed4841fe2f9c724fa4e290018a7d1bbf0533a55f86e367bad","observation_id":"434f5c42-a5a1-4f85-aeb5-c896307475a6","resolution":{"observed_at":"2026-06-27T09:50:48.301730Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.12908","last_updated":"2026-06-11T05:06:50Z","snapshot_observed_at":"2026-08-05T04:59:46.668803Z","submitted_at":"2026-06-11T05:06:50Z","title":"SENTINEL: Failure-Driven Reinforcement Learning for Training Tool-Using Language Model Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T06:49:12.070481Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.12908"},"observation_digest":"sha256:fcb15e42dc1f71af44341eab5026d66a8b58285f7dd8643a493c886a8015e6f1","observation_id":"64d89991-898c-4f9d-83ab-65751ace8828","resolution":{"observed_at":"2026-07-03T14:58:33.191600Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.19382","last_updated":"2026-06-14T10:54:24Z","snapshot_observed_at":"2026-07-06T23:54:41.980696Z","submitted_at":"2026-06-14T10:54:24Z","title":"DynAMO:Dynamic Asset Management Orchestration via Topological Multi-Agent Scheduling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T04:04:23.415175Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.19382"},"observation_digest":"sha256:61ecd725a4462a9365ef00602c5585f06568b5e9a520d16eda0282831d1fb061","observation_id":"b432a545-0c98-410b-9ef8-55c4d090ae68","resolution":{"observed_at":"2026-07-03T17:28:44.727542Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.19704","last_updated":"2026-06-18T02:02:46Z","snapshot_observed_at":"2026-08-02T16:15:58.108875Z","submitted_at":"2026-06-18T02:02:46Z","title":"Beyond Static Leaderboards: Predictive Validity for the Evaluation of LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T18:01:55.716141Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.19704"},"observation_digest":"sha256:4edb41e02145ce30225aef860994b6d2e6ccd33afc5045284fa8586d3b3a8f95","observation_id":"22815be2-c235-482a-8200-94c1d5d31fbe","resolution":{"observed_at":"2026-07-04T03:29:30.310286Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.24151","last_updated":"2026-06-23T05:17:22Z","snapshot_observed_at":"2026-08-04T04:36:24.557913Z","submitted_at":"2026-06-23T05:17:22Z","title":"Metis: Bridging Text and Code Memory for Self-Evolving Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T00:42:55.758578Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.24151"},"observation_digest":"sha256:decb0930a2db20ab886f62fb7c2173ca073e7eff9c1d8f412a7c05828223c740","observation_id":"9c54a24a-1415-432f-aabe-98facabdc82b","resolution":{"observed_at":"2026-07-04T16:29:56.693386Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":"2508.14704","doi":"10.48550/arxiv.2508.14704","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Luo et al","venue":"ArXiv.org","work_id":"b8148e6c-83f1-4051-b36f-12da866268e3","year":2025},"citing_paper":{"arxiv_id":"2606.28480","last_updated":"2026-06-26T17:59:51Z","snapshot_observed_at":"2026-07-07T00:02:33.644076Z","submitted_at":"2026-06-26T17:59:51Z","title":"TUA-Bench: A Benchmark for General-Purpose Terminal-Use Agents","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-30T01:19:54.081755Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2606.28480"},"observation_digest":"sha256:43df6760658557b4e32caecd340fab116922e5f30b739d70cb4b6c227bb49c42","observation_id":"64bf4e58-c472-490b-9086-b2cd84c4b7e1","resolution":{"observed_at":"2026-07-01T15:35:48.601770Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-07-30T15:06:50.485800Z","title":"MCP-Universe : Benchmarking large language models with real-world Model Context Protocol servers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23722","last_updated":"2026-07-26T15:38:28Z","snapshot_observed_at":"2026-08-06T15:13:10.286789Z","submitted_at":"2026-07-26T15:38:28Z","title":"E-Bench: Benchmarking Multi-Step Tool-Use Agents in Real-World Product Scenarios","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-30T15:06:50.485800Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2607.23722"},"observation_digest":"sha256:58df86fe6dd6eaa2fa34ce69b0c10e2ae221c484c4933a3ed0c592a4332e04c0","observation_id":"9faf4ce9-fe33-44b6-8e92-0c9a08061033","resolution":{"observed_at":"2026-07-30T15:06:50.485800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14704","snapshot_observed_at":"2026-08-03T05:43:20.572273Z","title":"arXiv:2508.14704","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29503","last_updated":"2026-07-31T15:07:18Z","snapshot_observed_at":"2026-08-06T01:56:46.602969Z","submitted_at":"2026-07-31T15:07:18Z","title":"The Grokked Illusion: True Equilibrium Mitigates Catastrophic Forgetting","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T05:43:20.572273Z"},"links":{"cited_paper":"/paper/2508.14704","citing_paper":"/paper/2607.29503"},"observation_digest":"sha256:128a60fba5b42fb25870876bf9056567349bb80b1c0c092ce61d6ddb1e420c74","observation_id":"4e53b575-3a82-4944-b637-80a33b86ca9b","resolution":{"observed_at":"2026-08-03T05:43:20.572273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.14704/citation-record","integrity":"/paper/2508.14704/integrity","json":"/paper/2508.14704/citation-record.json","paper":"/paper/2508.14704"},"outbound":[],"paper":{"arxiv_id":"2508.14704","last_updated":"2025-08-20T13:28:58Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T18:20:51.232791Z","submitted_at":"2025-08-20T13:28:58Z","title":"MCP-Universe: Benchmarking Large Language Models with Real-World Model Context Protocol Servers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2508.14704."}