{"as_of":"2026-08-13T10:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:01ee02f08bbf384da9cc36b51038e4796d821714842b7267c72c967cc9d23990","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T08:08:04.544564Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.10787/citation-record","integrity":"/paper/2605.10787/integrity","json":"/paper/2605.10787/citation-record.json","paper":"/paper/2605.10787"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:07:34.119737Z","title":"Langley , title =","venue":null,"work_id":"6cd283dc-0548-45e9-af07-6bc1005593ad","year":2000},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:def9ad49f47fecb10deac1efdc16575628dafe04e47a4a2fa31f08bf8693b35d","observation_id":"64829d28-c0bf-4662-8da1-cf5fa8c0bc5d","resolution":{"observed_at":"2026-05-21T08:09:52.262763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2501.05366","doi":"10.48550/arxiv.2501.05366","metadata_source":"pith","pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","venue":"cs.AI","work_id":"6246e99b-7b4e-4424-be78-3e1983932cdc","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:31f539b5d9d0012429144917e9cac60655ad55506bd597539468330f7b8b7bfc","observation_id":"cde92c6f-1628-40dc-a59e-254b2b28a3ea","resolution":{"observed_at":"2026-05-21T08:09:51.277152Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:bb3bda2ef778c7aad8bb35ebc0ec130d8f460d688a7531ff3547a233538dddce","observation_id":"79c3f095-27f5-47bd-a486-a748dc63da7c","resolution":{"observed_at":"2026-05-21T08:09:51.263706Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23383","last_updated":"2025-03-30T10:16:25Z","snapshot_observed_at":"2026-08-11T03:04:58.028847Z","submitted_at":"2025-03-30T10:16:25Z","title":"ToRL: Scaling Tool-Integrated RL","version":1},"cited_work":{"arxiv_id":"2503.23383","doi":"10.48550/arxiv.2503.23383","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.23383","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2503.23383 , year=","venue":"ArXiv.org","work_id":"aec6658a-b95b-4edc-942e-10f5203b0b6b","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2503.23383","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:eeea1b10f09cd970d2cc3f028904d63fd5dc9c0256890970471aa3037fdf98ee","observation_id":"e38e9970-45c9-415f-8c2f-b14b8d94550d","resolution":{"observed_at":"2026-05-21T08:09:51.260787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-08-09T21:47:22.232349Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":"2401.13919","doi":"10.48550/arxiv.2401.13919","metadata_source":"pith","pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","venue":"cs.CL","work_id":"12c1d840-af20-4a4e-8750-6b9c6266638f","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:768c3562e82fdc6c405084edb04bfb217a5265fe58863d2beb6c831157515be7","observation_id":"f10d98d3-0f6f-4ebe-a265-d7a461bc024e","resolution":{"observed_at":"2026-05-21T08:09:51.292643Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T15:05:03.599056Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"e5573c11-7e08-418e-87ce-b98b6e53972f","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:a5a56b8b998cced204e77ebaccd0b586e2192d609cc500672e446d36b1974058","observation_id":"a81eed18-1f81-4064-b2f5-061c1b1665d4","resolution":{"observed_at":"2026-05-21T08:09:52.260736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":"2408.06292","doi":"10.48550/arxiv.2408.06292","metadata_source":"pith","pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","venue":"cs.AI","work_id":"56b6b58d-e73a-4317-896e-36ac5f84e957","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:78fec4415b59ed02c1a4928b0c75198c54814e983adf69945e5a75b0c4d83614","observation_id":"a3a65ebf-aaa3-4fa0-ab86-fcb87b296a1d","resolution":{"observed_at":"2026-05-21T08:09:51.235176Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:02:58.716193Z","title":"The eleventh international conference on learning representations , year=","venue":null,"work_id":"d0870e7f-a33a-4020-8109-459b41853021","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:e25c87e442c46b14e7f8ca2d464dc0d5756905341297913f0caeee3c9b93610d","observation_id":"b7a7f456-3f3b-44a2-81e4-ce4f2dac55c3","resolution":{"observed_at":"2026-05-21T08:09:52.253984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing: System Demonstrations , pages=","venue":null,"work_id":"6e234377-2031-4a4d-b0b7-d02b2f0a3970","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:58964990bb6cfb804005c60fdb5d0f824f1fc952cb1140810e59c079719b25b6","observation_id":"513919e0-0d67-48c0-88ab-19c52268634e","resolution":{"observed_at":"2026-05-21T08:09:52.256309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20453","last_updated":"2025-08-28T05:58:57Z","snapshot_observed_at":"2026-08-05T15:10:31.464813Z","submitted_at":"2025-08-28T05:58:57Z","title":"MCP-Bench: Benchmarking Tool-Using LLM Agents with Complex Real-World Tasks via MCP Servers","version":1},"cited_work":{"arxiv_id":"2508.20453","doi":"10.48550/arxiv.2508.20453","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang et al","venue":"ArXiv.org","work_id":"09a5d0b4-4a61-4a3e-a239-f3d9368305d5","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2508.20453","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:a8ac551294de2af3b298e24e659ff57f235a948b3e95ab3f5c49af895008f988","observation_id":"7fbcf87d-e43d-4bf5-b616-d1fef4bc1c42","resolution":{"observed_at":"2026-05-21T08:09:51.241818Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":"2307.16789","doi":"10.48550/arxiv.2307.16789","metadata_source":"pith","pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","venue":"cs.AI","work_id":"3c555b48-a4d9-42dd-9fdd-0f6018fbe9cb","year":2023},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:2b5ffbb8b7d7ce66adbdd9ccf2c937f296cbe534957b6d0b61202a0ee0ad3f7a","observation_id":"7f410ef5-934d-4d6d-b6a9-715c15005dd7","resolution":{"observed_at":"2026-05-21T08:09:51.250993Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04253","last_updated":"2024-02-06T18:59:57Z","snapshot_observed_at":"2026-08-13T04:24:53.739413Z","submitted_at":"2024-02-06T18:59:57Z","title":"AnyTool: Self-Reflective, Hierarchical Agents for Large-Scale API Calls","version":1},"cited_work":{"arxiv_id":"2402.04253","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04253","snapshot_observed_at":"2026-07-03T21:18:59.744091Z","title":"Anytool: Self-reflective, hierarchical agents for large-scale api calls","venue":null,"work_id":"c86cacba-590b-4642-8164-0e72e0aacaab","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2402.04253","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:c8e049718bd32a66e5aaeeb9938fdfd33ca704e972347510f027408494487693","observation_id":"5d401bf6-8419-4056-be90-c17f0a3d8fbb","resolution":{"observed_at":"2026-05-21T08:09:51.238549Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":"9051d199-3d36-4149-9955-2d01a5300e03","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:7172a8c9e7bec6b87f24369573cee01005b809de712da7211228a8e47afabd43","observation_id":"82b16947-7659-4df3-9f41-177646597bc8","resolution":{"observed_at":"2026-05-21T08:09:52.258302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-08T21:08:39.676079Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":"2406.12045","doi":"10.48550/arxiv.2406.12045","metadata_source":"pith","pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","venue":"cs.AI","work_id":"6a8d8dc4-0cc0-4052-8109-abbcdcd4a962","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:507bf2743eee0e46d5848ef06e95414f77061f4b25a81257bb4e40e35cf0d119","observation_id":"ad999b72-c1c3-47a4-9317-1ba63e77e731","resolution":{"observed_at":"2026-05-21T08:09:51.301730Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":"2506.07982","doi":"10.48550/arxiv.2506.07982","metadata_source":"pith","pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","venue":"cs.AI","work_id":"3a498b1a-455f-4667-b572-c5216c99a89c","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:45891d70882937db106a0b5963aba44af873c33abd51591e8f9821af99ab491d","observation_id":"8d04b207-e7ed-43b9-b1a4-137e5418517d","resolution":{"observed_at":"2026-05-21T08:09:51.244823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:0dbcd0e55e570eb41c26a0ed4036d316add76b3b3d12c41dbbfd606185aea4a1","observation_id":"4dc23ab0-a685-4d08-9947-d2f5293ba476","resolution":{"observed_at":"2026-05-21T08:09:51.289844Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T22:00:10.225712Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c1c15f72-ba45-4d5a-8104-a9b591f6c68f","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:aff26142e8c22fdc1d2f56634c60ea26df4400f887913328c70cc46fab1953ac","observation_id":"a8cc783b-7c09-4cea-9dfc-453c40d3ddb2","resolution":{"observed_at":"2026-05-21T08:09:52.249748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23278","last_updated":"2025-10-07T07:13:32Z","snapshot_observed_at":"2026-08-13T06:47:33.344393Z","submitted_at":"2025-03-30T01:58:22Z","title":"Model Context Protocol (MCP): Landscape, Security Threats, and Future Research Directions","version":3},"cited_work":{"arxiv_id":"2503.23278","doi":"10.48550/arxiv.2503.23278","metadata_source":"pith","pith_arxiv_id":"2503.23278","snapshot_observed_at":"2026-07-11T02:47:49.588216Z","title":"Model Context Protocol (MCP): Landscape, Security Threats, and Future Research Directions","venue":"cs.CR","work_id":"3eff6b57-ab58-474f-afd9-4e115a5818a9","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2503.23278","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:67d5a5460d8123bc9f321addfbbe893fed7f54a6de6da4202ca2630f9f325964","observation_id":"5714d66f-93c4-41c6-bb92-e6be0a2fc0f0","resolution":{"observed_at":"2026-05-21T08:09:51.305160Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-24T11:23:19.786497+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T11:23:19.786497+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07672","last_updated":"2025-06-09T11:50:33Z","snapshot_observed_at":"2026-08-12T21:32:53.600136Z","submitted_at":"2025-06-09T11:50:33Z","title":"MCPWorld: A Unified Benchmarking Testbed for API, GUI, and Hybrid Computer Use Agents","version":1},"cited_work":{"arxiv_id":"2506.07672","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07672","snapshot_observed_at":"2026-07-03T16:58:43.632383Z","title":"arXiv preprint arXiv:2506.07672 , year=","venue":null,"work_id":"2b448a38-d99a-47ec-ad81-c94e78b0031c","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2506.07672","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:7516a60c1ae8ad53405f20ff8b5a1ba43dd21090dd8354086af0fc2dad92157c","observation_id":"f49e1e44-bb4c-4f36-a2b7-306019a8585a","resolution":{"observed_at":"2026-05-21T08:09:51.280527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.01780","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T20:28:55.459400Z","title":"Mo et al","venue":null,"work_id":"c11cf6cc-103f-4dd4-b614-287868e48e3f","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:7ea82512aa761737f0284877de95622c06f82461c544873daa1f8a32fa8b4f5c","observation_id":"9f082c99-b21c-4773-a3cb-650ce9c4645e","resolution":{"observed_at":"2026-05-21T08:09:51.254538Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04550","doi":"10.48550/arxiv.2510.04550","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2510.04550 , year=","venue":"ArXiv.org","work_id":"47ea0bcb-42b8-4e0c-9192-911e908c703d","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:80305920a2ac0828c98dd46d5e3fa60c2fe1b8ce7617caccf425b4c85d115ff9","observation_id":"635c1359-2c31-4fd9-abe1-9c24191f4f41","resolution":{"observed_at":"2026-05-21T08:09:51.286787Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:51.591086+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:51.591086+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16416","last_updated":"2026-04-23T17:36:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-20T17:59:23Z","title":"Survey on Evaluation of LLM-based Agents","version":2},"cited_work":{"arxiv_id":"2503.16416","doi":"10.48550/arxiv.2503.16416","metadata_source":"pith","pith_arxiv_id":"2503.16416","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Survey on Evaluation of LLM-based Agents","venue":"cs.AI","work_id":"d9ac1186-88b1-41bd-9bc7-8a0b87e6f305","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2503.16416","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:cabc000d80f301255f1449a8784cadc026eae544c6a4ae5f80756c7c1ede029a","observation_id":"f5c2bfcc-0cc2-4ba1-a130-03f7dd0f8b2e","resolution":{"observed_at":"2026-05-21T08:09:51.295381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:20:44.248546+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:20:44.248546+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:e4a5216a47b98e0fd200530674d79e1a992286cd7ed2bf414090890f9ec048ed","observation_id":"fbc60668-9b9d-4912-ad01-1fcdc08bccf4","resolution":{"observed_at":"2026-05-21T08:09:51.270067Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T06:43:29.957941Z","title":"2025 , eprint=","venue":null,"work_id":"92a933bb-6195-449a-8230-f8407d9b8afc","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:ad4083e62cb7c109ebe14966f78c8d53d0cfdf11981ae79a83fbc33bd181de13","observation_id":"f8063380-a8ff-4886-9352-728eda06d431","resolution":{"observed_at":"2026-05-21T08:09:52.266412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:d64c6f2740e12e3e0b62d261279002854dcb99c6c1009f43545d96d1f6d6e22b","observation_id":"5e535fe2-22ff-4651-8d18-26bebd4650f0","resolution":{"observed_at":"2026-05-21T08:09:51.231660Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9a299dc3-1a8d-4c3f-84eb-8dfb426c3fbd","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:b7566be33cb361bd7c774c6a3192714f1f46d2ad8c5ef6a8ed0ac3305bf02603","observation_id":"ca7f54d7-6815-4902-beea-5e4326153a06","resolution":{"observed_at":"2026-05-21T08:09:52.264583Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fd06ed5f-c399-4198-b511-1dd59f5156d6","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:4ceeb4578378b01adb6a3978d024ba4cc11cf6f3296d198d883fe37da3807779","observation_id":"248e9ac4-a198-4c77-9614-510932d6bfa5","resolution":{"observed_at":"2026-05-21T08:09:52.268552Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ccd35216-3515-42bd-9756-8ad9ebb37a26","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:b5a18c289133985e585f246b63f92153e595a80ed1612848fa6adb385552505b","observation_id":"0e19e981-dd63-4493-8dc7-9a7c6ea43314","resolution":{"observed_at":"2026-05-21T08:09:52.272740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7072b757-42f6-41fd-9c9e-6aa88cb9ba60","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:c6395947357fcf0d588dfff46053dbd03c8c4c44dd752f6b44a09ee1a0edcda6","observation_id":"e0cf5376-ea12-45ef-af1b-a9ad8ca0aa95","resolution":{"observed_at":"2026-05-21T08:09:52.251873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:316c4727db8d4af880ddce9b4bfe1f7dc7ca7315c6034c8217feb721805ed37a","observation_id":"596b6a9f-f569-4013-b486-f38b1b7c088a","resolution":{"observed_at":"2026-05-21T08:09:51.257757Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:dadaf5311d98d9e84156e05f6a2627f74d184392242af0e1632e31ac1b3c9dee","observation_id":"f9f2b629-6d8f-41ce-a081-f76a95080418","resolution":{"observed_at":"2026-05-21T08:09:51.274127Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:192b070aed3eb01abb6f1ed41007222adc2c2314c7f3e9e52e951ffdd8daa783","observation_id":"e63900fd-f256-4bfe-87ea-dd5cda1dfc48","resolution":{"observed_at":"2026-05-21T08:09:51.267150Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-08-11T03:34:09.767397Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:25c64613d2adc5706e9305c7ecdc372efb1b3e149e709c608550c8abdf1bba9e","observation_id":"e1a18eb0-4d23-49a0-9b31-0735b5a81d0d","resolution":{"observed_at":"2026-05-21T08:09:51.283396Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T22:54:10.690500Z","title":"arXiv e-prints , pages=","venue":null,"work_id":"e3d36c3d-7b21-4239-8c39-24564d8e9696","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:ff11d06326eff960d93f6eef58c906f0e4f02ca9e89810c6df7c8be55e42e2a0","observation_id":"c972d9c0-4c5a-47a6-9ff0-4754b88ff3d7","resolution":{"observed_at":"2026-05-21T08:09:52.274659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03275","last_updated":"2025-05-06T08:05:35Z","snapshot_observed_at":"2026-08-13T09:28:15.651210Z","submitted_at":"2025-05-06T08:05:35Z","title":"RAG-MCP: Mitigating Prompt Bloat in LLM Tool Selection via Retrieval-Augmented Generation","version":1},"cited_work":{"arxiv_id":"2505.03275","doi":"10.48550/arxiv.2505.03275","metadata_source":"pith","pith_arxiv_id":"2505.03275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2505.03275 , year=","venue":"cs.AI","work_id":"a17d2b90-a81f-465f-b8f8-558a781a97f0","year":2025},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/2505.03275","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:7f66170da9c3a3b41196ef9f0980a6907400f3abb19293ef6795da6071200c51","observation_id":"5088c91c-ab89-47fe-9a66-82df53a5aea6","resolution":{"observed_at":"2026-05-21T08:09:51.298758Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:20:38.438789+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:20:38.438789+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scholarpedia , volume=","venue":null,"work_id":"db9555b7-3107-45a2-94df-055b497bbfb2","year":null},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:1ee5e86c047f85456293216632d8a0c43fa3dd0e0cc097eb8425575c19ee9142","observation_id":"0f768033-6540-4c06-8272-8e96a16a5553","resolution":{"observed_at":"2026-05-21T08:09:52.247571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":"1908.10084","doi":"10.48550/arxiv.1908.10084","metadata_source":"pith","pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","venue":"cs.CL","work_id":"27adfcc9-2a67-43d6-a844-78309012411f","year":2019},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:795ea17169e9b8b3eda055dd77a2b74c897604777acfae2b9abeb02c451e3bf7","observation_id":"95cd9562-e425-4992-8bb9-e0e2b4045e3f","resolution":{"observed_at":"2026-05-21T08:09:51.248018Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T06:19:15.148899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"2ebeb8f6-debc-46a7-96c8-a6017983cae1","year":2024},"citing_paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-21T08:08:04.544564Z"},"links":{"citing_paper":"/paper/2605.10787"},"observation_digest":"sha256:3de40466ca533c7e5b81b4edf7ccec6b797d4f7937e59882f3c8254af70b12e4","observation_id":"aa6e7445-c326-4e75-9621-b15f7d8f3c92","resolution":{"observed_at":"2026-05-21T08:09:52.270713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.10787","last_updated":"2026-05-20T01:39:17Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T22:55:54.365434Z","submitted_at":"2026-05-11T16:20:51Z","title":"ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":20,"parse_uncertain":2,"unresolved":2,"verified_exact":4,"verified_fuzzy":10},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2605.10787."}