{"as_of":"2026-08-08T13:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9911366403d90e34d632c92988c30334cad4bcd7bccf3fefb89d8611907a461b","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:46:02.635196Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T15:10:04.253250Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T15:10:16.398252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"cited_work":{"arxiv_id":"2507.12806","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu et al","venue":null,"work_id":"9beeabc2-0c54-484b-8552-f289e1d4da58","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T08:28:16.904091Z"},"links":{"cited_paper":"/paper/2507.12806","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:7d21d63696df39de8748a384eaada7378478774e10e29a8d98a70fac2a7df2e6","observation_id":"f50b43b1-2286-4179-9d51-536a3c89175b","resolution":{"observed_at":"2026-05-16T08:30:45.621785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"cited_work":{"arxiv_id":"2507.12806","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12806","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liu et al","venue":null,"work_id":"9beeabc2-0c54-484b-8552-f289e1d4da58","year":2025},"citing_paper":{"arxiv_id":"2602.00933","last_updated":"2026-05-19T23:26:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-31T23:19:39Z","title":"MCP-Atlas: A Large-Scale Benchmark for Tool-Use Competency with Real MCP Servers","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T15:10:04.253250Z"},"links":{"cited_paper":"/paper/2507.12806","citing_paper":"/paper/2602.00933"},"observation_digest":"sha256:03c39493b6a5fa8e5f72741c43f1cb0f10d4c8fd49f2c2c36fd8a36889ff20ed","observation_id":"639cab6f-2318-46d1-b552-f2ad2c5d1ae4","resolution":{"observed_at":"2026-05-21T15:10:16.401136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12806/citation-record","integrity":"/paper/2507.12806/integrity","json":"/paper/2507.12806/citation-record.json","paper":"/paper/2507.12806"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.805851Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.805851Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4c2497b143cd4dff47a1b2ce1dcfb305b697f2094a18315227ac49fddc9a4645","observation_id":"965e8d88-5920-4fa0-997d-18671108562e","resolution":{"observed_at":"2026-08-06T16:45:58.805851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:58.871577Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.871577Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:39673f4493950ad3b6f7643d5bf6240542387db3e321a7c7bdbf01bb3099ca3f","observation_id":"f48c8dec-5f67-4714-8de1-2e2eb14d62c1","resolution":{"observed_at":"2026-08-06T16:45:58.871577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.378764Z","title":null,"venue":null,"work_id":"7d846a89-b8b7-47ca-9c5f-d99d434db040","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:58.971979Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:68d17788bc55994622ef48ef2325802ff55e623fabb8c25fb3ed6e5e6c9a2267","observation_id":"54a68f72-8b63-4ba7-9b90-4afa6c213840","resolution":{"observed_at":"2026-08-06T16:46:06.424251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.287735Z","title":null,"venue":null,"work_id":"71101a82-96fc-4541-b988-940642d84f1f","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.050121Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:08eb342d5dbe43635fd667d313b7ce663df5f16953085a6046639b8c33ebaedf","observation_id":"0ac6f1bd-aad2-4886-b45b-2511928efe4b","resolution":{"observed_at":"2026-08-06T16:46:06.326853Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07303","last_updated":"2024-01-14T14:35:09Z","snapshot_observed_at":"2026-08-08T05:58:10.636459Z","submitted_at":"2024-01-14T14:35:09Z","title":"On extensions of the Jacobson-Morozov theorem to even characteristic","version":1},"cited_work":{"arxiv_id":"2401.07303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07303","snapshot_observed_at":"2026-08-06T16:46:04.392231Z","title":"On extensions of the Jacobson-Morozov theorem to even characteristic","venue":"math.RT","work_id":"d34baad3-6bf2-4e38-b204-8c55f108061e","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.124683Z"},"links":{"cited_paper":"/paper/2401.07303","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:a8669742ad29daa54d8be68bd7dbf4407692fba122128135b7f3d84871777f3b","observation_id":"7f2ccccd-f0fe-44b7-975a-a4917b8daabc","resolution":{"observed_at":"2026-08-06T16:46:04.463822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.191336Z","title":null,"venue":null,"work_id":"fc47e508-8c58-4a55-bb9a-e31cad937bc5","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.215761Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:04b7df3cb544c674f023538640c7e911efcc26791da3d5976310876f9e3b895d","observation_id":"6ddcdea5-a3c5-4978-b407-ccd568d67cb5","resolution":{"observed_at":"2026-08-06T16:46:06.218192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:06.049696Z","title":null,"venue":null,"work_id":"666a0db1-d6ac-4a86-b588-f3980c96132f","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.308374Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:46c7011dc2f9cf99dbe54571c38321d8bbd571d390b0d4b7008ea7ae14b9f69d","observation_id":"ff70678c-e4b2-44c1-80ea-76173553b1ad","resolution":{"observed_at":"2026-08-06T16:46:06.117258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04337","last_updated":"2024-02-06T19:20:50Z","snapshot_observed_at":"2026-08-08T09:12:21.911371Z","submitted_at":"2024-02-06T19:20:50Z","title":"High-temperature oxidation and nitridation of substoichiometric zirconium carbide in isothermal air","version":1},"cited_work":{"arxiv_id":"2402.04337","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.04337","snapshot_observed_at":"2026-08-06T16:46:04.208156Z","title":"High-temperature oxidation and nitridation of substoichiometric zirconium carbide in isothermal air","venue":"cond-mat.mtrl-sci","work_id":"92370a19-f9ff-46bd-b89d-2f38124842b6","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.402697Z"},"links":{"cited_paper":"/paper/2402.04337","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:793229cae124fa1cb18de9a283b272affb02a1202fa127a703b9448a426e793b","observation_id":"382aea7f-4f3e-4d31-8b83-8ccda811beb7","resolution":{"observed_at":"2026-08-06T16:46:04.280548Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:45:59.503158Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.503158Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:66a03ed2bfa56f168b1a78a5dd36874fe246cce5d0e479f49ce8730e47257120","observation_id":"9963f502-26c4-4230-be21-15f6fc5160b3","resolution":{"observed_at":"2026-08-06T16:45:59.503158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18836","last_updated":"2025-08-05T17:22:49Z","snapshot_observed_at":"2026-08-07T18:44:19.906571Z","submitted_at":"2025-02-26T05:24:22Z","title":"REALM-Bench: A Benchmark for Evaluating Multi-Agent Systems on Real-world, Dynamic Planning and Scheduling Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18836","snapshot_observed_at":"2026-08-06T16:45:59.600438Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.600438Z"},"links":{"cited_paper":"/paper/2502.18836","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ce33bc3a240d8ed9c315b8a4ddc3e5bc77e34017bac27239d5de086512bf7f38","observation_id":"8a58901e-2fd1-4e76-b9f1-3f512b7b46ab","resolution":{"observed_at":"2026-08-06T16:45:59.600438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T16:45:59.689261Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.689261Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:037a09d84100e98ec5031806664b599996014b9ad3850bfd97db966170bdbec6","observation_id":"52fde6de-9293-4f89-9276-73de583e86ea","resolution":{"observed_at":"2026-08-06T16:45:59.689261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02298","last_updated":"2025-06-02T22:36:02Z","snapshot_observed_at":"2026-08-07T22:42:07.983750Z","submitted_at":"2025-06-02T22:36:02Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","version":1},"cited_work":{"arxiv_id":"2506.02298","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02298","snapshot_observed_at":"2026-08-06T16:46:03.964361Z","title":"LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback","venue":"cs.CL","work_id":"1c672310-9bab-42fb-9e5f-619d6a94d01c","year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.767986Z"},"links":{"cited_paper":"/paper/2506.02298","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:56dbc219bac754712ca6da663b7099ec920c87c98ffa190c3ff178b7f8018548","observation_id":"a05bf665-2307-4f98-84fe-e0c110d1fff4","resolution":{"observed_at":"2026-08-06T16:46:04.002763Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03456","last_updated":"2025-06-05T09:50:10Z","snapshot_observed_at":"2026-07-06T18:26:01.717861Z","submitted_at":"2024-06-05T17:00:16Z","title":"Recurrent neural chemical reaction networks that approximate arbitrary dynamics","version":2},"cited_work":{"arxiv_id":"2406.03456","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03456","snapshot_observed_at":"2026-08-06T16:46:03.846910Z","title":"Recurrent neural chemical reaction networks that approximate arbitrary dynamics","venue":"q-bio.MN","work_id":"12a04534-46a9-4999-95cd-35b077fc18f5","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.835670Z"},"links":{"cited_paper":"/paper/2406.03456","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:33788ae76d6b657445770df79cf92dee8310e65d1d42adf6c2468b19e024dfc2","observation_id":"b413d103-a494-4f61-978e-3a676697e357","resolution":{"observed_at":"2026-08-06T16:46:03.888765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.925959Z","title":null,"venue":null,"work_id":"d75bb813-3edd-4dbb-ace6-377befe83c49","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T16:45:59.913761Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:c049aa8e11911f8b17b3517b8cfe083d81bf68d2385d44611ab77f68da23825e","observation_id":"0c2a0c8e-840a-49e8-a759-c6788b9e8af9","resolution":{"observed_at":"2026-08-06T16:46:05.972064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-06T16:46:00.003696Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.003696Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:34146242bb65d80b1db2629fb62ae8e7d57bfa409048efbb166a0f142401430e","observation_id":"d5e270d4-5040-4774-9917-b0b1f1891b6b","resolution":{"observed_at":"2026-08-06T16:46:00.003696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-06T16:46:00.105921Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.105921Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:5f809290d85af4c6bad7d6d3e0409d3b0122bf347393e874c70bbe6d217d127c","observation_id":"da1ec4f5-2cea-4d02-9714-852c90562a85","resolution":{"observed_at":"2026-08-06T16:46:00.105921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13547","last_updated":"2025-06-26T01:05:54Z","snapshot_observed_at":"2026-08-06T09:34:50.120885Z","submitted_at":"2024-11-20T18:56:22Z","title":"ToolScan: A Benchmark for Characterizing Errors in Tool-Use LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13547","snapshot_observed_at":"2026-08-06T16:46:00.165311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.165311Z"},"links":{"cited_paper":"/paper/2411.13547","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:0f30f0ebfdb6e40c8d307c6e6d730e65138919d8631b4eba1e3d3f5961370739","observation_id":"0e3145b2-54c9-4e9e-b271-36a5d95ca7b4","resolution":{"observed_at":"2026-08-06T16:46:00.165311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.763349Z","title":null,"venue":null,"work_id":"d09e9b80-5717-473f-bc5e-4437810dc4a3","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.236217Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:70c1d30172ae930793dafe2fa70d29cdf95614b2b2e479e059dd9cc696984375","observation_id":"f16da7f4-79b5-4715-9121-e8d03a7cfd06","resolution":{"observed_at":"2026-08-06T16:46:05.829666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-06T16:46:00.317956Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.317956Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:afbdcb5fb623a60f19a754f0c1e24196f89afd39d77853f293551722ef95fbd3","observation_id":"39716159-e2c8-490a-8800-1e82ea79b651","resolution":{"observed_at":"2026-08-06T16:46:00.317956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18528","last_updated":"2024-10-24T08:21:51Z","snapshot_observed_at":"2026-07-06T19:38:57.409491Z","submitted_at":"2024-10-24T08:21:51Z","title":"PRACT: Optimizing Principled Reasoning and Acting of LLM Agent","version":1},"cited_work":{"arxiv_id":"2410.18528","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18528","snapshot_observed_at":"2026-08-06T16:46:03.662816Z","title":"PRACT: Optimizing Principled Reasoning and Acting of LLM Agent","venue":"cs.AI","work_id":"394fb708-2fdb-4c37-a01e-9499cc086039","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.387306Z"},"links":{"cited_paper":"/paper/2410.18528","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:779581bc4a31e41365c462aafe84d90688c625e7ee125da47d4d800fabdbffe1","observation_id":"10d30c61-c805-483a-aca3-821be6d5c8e2","resolution":{"observed_at":"2026-08-06T16:46:03.694873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05960","last_updated":"2023-08-11T06:37:54Z","snapshot_observed_at":"2026-08-02T20:56:26.359474Z","submitted_at":"2023-08-11T06:37:54Z","title":"BOLAA: Benchmarking and Orchestrating LLM-augmented Autonomous Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05960","snapshot_observed_at":"2026-08-06T16:46:00.503290Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.503290Z"},"links":{"cited_paper":"/paper/2308.05960","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:751f4a1e1a382d28e7b1d19787a8bbfe448cf4d7bb07c8f349fc8984edc05fec","observation_id":"f1500648-c6dc-4fb5-bec1-bc9d37bc47dd","resolution":{"observed_at":"2026-08-06T16:46:00.503290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15538","last_updated":"2024-02-23T06:25:20Z","snapshot_observed_at":"2026-08-07T06:06:05.718406Z","submitted_at":"2024-02-23T06:25:20Z","title":"AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15538","snapshot_observed_at":"2026-08-06T16:46:00.571687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.571687Z"},"links":{"cited_paper":"/paper/2402.15538","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:a2f7607c1847fade515ccc2613a582df37653747c2fc915dfa59a3d127f07556","observation_id":"3b85cbb9-9ee2-4265-8954-2dbfe0457389","resolution":{"observed_at":"2026-08-06T16:46:00.571687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.590767Z","title":null,"venue":null,"work_id":"f817cb8d-744a-4b3a-9a37-5aae215c01a4","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.643162Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:82c42b966fe36eb2eda339c20e96353328b9af4a1d7cdc2d0baf1dc033849376","observation_id":"3533abeb-e1d2-4a2d-a2b4-fe04b0e9cc98","resolution":{"observed_at":"2026-08-06T16:46:05.691587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06416","last_updated":"2025-05-09T20:30:37Z","snapshot_observed_at":"2026-08-07T15:48:19.425532Z","submitted_at":"2025-05-09T20:30:37Z","title":"ScaleMCP: Dynamic and Auto-Synchronizing Model Context Protocol Tools for LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06416","snapshot_observed_at":"2026-08-06T16:46:00.702329Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.702329Z"},"links":{"cited_paper":"/paper/2505.06416","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:a43410acdd1bfad5ea21b5644fdfae12ad11e083837d6995e437956ee6380286","observation_id":"5bacc67b-035f-41f7-9ede-cda04be96e11","resolution":{"observed_at":"2026-08-06T16:46:00.702329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-06T16:46:00.781635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.781635Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:05e7fb434b390741d15c71d26f3eec95ccb0c13bc891881eecfe8c05c43a6942","observation_id":"59d6be4b-64f8-49cf-977e-956a9ec79f4d","resolution":{"observed_at":"2026-08-06T16:46:00.781635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:00.878106Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.878106Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:81b94da6d38d5ccb693745c73d6ec1f677fed79284382eb0c36162b463a9572e","observation_id":"601a5aac-4ffb-4790-836f-c4219bfdb3fc","resolution":{"observed_at":"2026-08-06T16:46:00.878106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T16:46:00.956599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:00.956599Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:25752040fcf430c38d7cbe91598fb7a9023300bdaa8a875bcbd33c4cd9d352c5","observation_id":"4b9de82d-5851-4695-a7c3-af6f7b0f7fc1","resolution":{"observed_at":"2026-08-06T16:46:00.956599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.393818Z","title":null,"venue":null,"work_id":"21ad04dc-7e91-4b62-8ced-43d1dcf4cdb1","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.032125Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:1b4a9a8a47026bf2953a023ae95b5e6302a0961cc92f36cc8a53b70aae6bfaf0","observation_id":"1f61e1be-832c-47c5-ab38-ffe3057f52e3","resolution":{"observed_at":"2026-08-06T16:46:05.487334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-06T16:46:01.118506Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.118506Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:33d93238d90864762beb16dded12856a6e97064902f88ffda4cf3601739826ab","observation_id":"afb76a43-b3a7-42b7-aa5e-5c8f1f69623b","resolution":{"observed_at":"2026-08-06T16:46:01.118506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.232428Z","title":null,"venue":null,"work_id":"6147db2d-9f77-40f0-a71e-1bb1b8695b1f","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.176261Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:0e3959a814e0880d8cc06e8f863f4ecf7e57f97d1447f2b01ffa014b916be43e","observation_id":"98a46a96-655c-4937-a520-f84420cf7735","resolution":{"observed_at":"2026-08-06T16:46:05.319496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:05.084693Z","title":null,"venue":null,"work_id":"8052eaf2-1708-426d-a105-0c63c7c6b1de","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.251698Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4e047a488ce39ac1fd4f2e450e49b5a73f688691789d870ef66bb16cc9294642","observation_id":"277c3b40-f282-435e-8481-dc53cbe330fc","resolution":{"observed_at":"2026-08-06T16:46:05.147837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20616","last_updated":"2025-08-20T18:44:21Z","snapshot_observed_at":"2026-08-07T17:41:19.818698Z","submitted_at":"2025-02-28T00:43:35Z","title":"PersonaBench: Evaluating AI Models on Understanding Personal Information through Accessing (Synthetic) Private User Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20616","snapshot_observed_at":"2026-08-06T16:46:01.340983Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.340983Z"},"links":{"cited_paper":"/paper/2502.20616","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:d71a24810378075de7dbe353e48c6321ce3f90be59f2c6bc023d8afa10fdca87","observation_id":"cea0ddfc-24f6-4de2-b2ae-41327a4f6009","resolution":{"observed_at":"2026-08-06T16:46:01.340983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02705","last_updated":"2024-05-04T16:25:23Z","snapshot_observed_at":"2026-07-06T18:09:51.117905Z","submitted_at":"2024-05-04T16:25:23Z","title":"Peak Age of Information under Tandem of Queues","version":1},"cited_work":{"arxiv_id":"2405.02705","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.02705","snapshot_observed_at":"2026-08-06T16:46:03.276254Z","title":"Peak Age of Information under Tandem of Queues","venue":"cs.IT","work_id":"2cd0a92a-bd81-46a3-bc78-85f711d8bfd4","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.420089Z"},"links":{"cited_paper":"/paper/2405.02705","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:2708354885a67d13ace8de00d37ac2c844f2080850ad9c59532d375117eadbf2","observation_id":"c31e5581-2880-462d-af0b-097ac6237e88","resolution":{"observed_at":"2026-08-06T16:46:03.339657Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.967296Z","title":null,"venue":null,"work_id":"979c9f22-2c65-4938-8378-440641f2e824","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.505456Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:29926e4ba28a8f7dbf65bb42564ce6359d3f8e6e6dd0cad9abfe25b10a587f87","observation_id":"91de0b95-21ad-4e1d-ad2b-f137266aff4e","resolution":{"observed_at":"2026-08-06T16:46:05.019555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.854029Z","title":null,"venue":null,"work_id":"35a31b5f-4a7a-42f2-89c3-dcaadd2fd8a2","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.570593Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:d3ee4af87ab0ac2c02e047dfd578f004285e72a1eb4fd764b5c55539570de723","observation_id":"f13d3aeb-25cb-4548-b755-eafdb31c03dd","resolution":{"observed_at":"2026-08-06T16:46:04.909834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19314","last_updated":"2025-04-18T19:36:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-27T16:47:42Z","title":"LiveBench: A Challenging, Contamination-Limited LLM Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19314","snapshot_observed_at":"2026-08-06T16:46:01.623365Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.623365Z"},"links":{"cited_paper":"/paper/2406.19314","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:221be55a54925fd1af1242593701efc9572597a7bf65def7794b96300c6d99e1","observation_id":"0fe92b4f-1fe3-41e0-8586-4fe378d8f71b","resolution":{"observed_at":"2026-08-06T16:46:01.623365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.691488Z","title":null,"venue":null,"work_id":"58eae20c-5ae1-4199-9143-6d5c7830a6b8","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.676364Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f4ddbc64bbf26618b6c7173b8ae587840680c1786f1e5eb6d6bc50d47d693190","observation_id":"b196f587-3af0-4831-97d9-a95dceff3733","resolution":{"observed_at":"2026-08-06T16:46:04.750655Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-07T10:10:50.201348Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-06T16:46:01.738182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.738182Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:869c2f8b36bb2533dd395e4125b6d8c1f412ee7d5fdb306d4c34630831ca465d","observation_id":"6aaf830b-3ec9-4809-b1b8-55ab9db3030f","resolution":{"observed_at":"2026-08-06T16:46:01.738182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-06T16:46:01.826594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.826594Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:ea0cdc5e12dd07b89e3c220653cb597c21402bda173975e7e672137639792a07","observation_id":"24645806-899e-471a-9159-5064ce9a8a91","resolution":{"observed_at":"2026-08-06T16:46:01.826594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07672","last_updated":"2025-06-09T11:50:33Z","snapshot_observed_at":"2026-08-07T12:20:23.563045Z","submitted_at":"2025-06-09T11:50:33Z","title":"MCPWorld: A Unified Benchmarking Testbed for API, GUI, and Hybrid Computer Use Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.07672","snapshot_observed_at":"2026-08-06T16:46:01.921739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.921739Z"},"links":{"cited_paper":"/paper/2506.07672","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4d07af12586203250fc10f1d482f760c5835e361a8fc7229604a369a029604fa","observation_id":"1eb775e8-6a66-43bf-8819-92406bbd28fe","resolution":{"observed_at":"2026-08-06T16:46:01.921739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:46:04.543544Z","title":null,"venue":null,"work_id":"0727227a-8176-4e9c-9e85-7263739030c8","year":2022},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:01.974886Z"},"links":{"citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:c8c66e70c6e00b35bd1e8a57a313be926bf6a446039f8f2a5d558e4790aec815","observation_id":"8cdc92fc-d07f-4d04-9a2a-05d6c3adb33f","resolution":{"observed_at":"2026-08-06T16:46:04.613287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11432","last_updated":"2025-03-02T04:04:03Z","snapshot_observed_at":"2026-08-02T07:33:16.089197Z","submitted_at":"2023-08-22T13:30:37Z","title":"A Survey on Large Language Model based Autonomous Agents","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11432","snapshot_observed_at":"2026-08-06T16:46:02.056791Z","title":"Yu, Li-Rong Sun, and 1 others","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.056791Z"},"links":{"cited_paper":"/paper/2308.11432","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:f14e945207987ccb1e5f4f7ef5175f3a59b4e027f33c39a11caf9fa9dc4fbfa0","observation_id":"a3b0ae8a-5fc8-465d-bbed-990c8b4dfcc3","resolution":{"observed_at":"2026-08-06T16:46:02.056791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01574","last_updated":"2024-11-06T02:54:00Z","snapshot_observed_at":"2026-08-06T00:29:17.674418Z","submitted_at":"2024-06-03T17:53:00Z","title":"MMLU-Pro: A More Robust and Challenging Multi-Task Language Understanding Benchmark","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01574","snapshot_observed_at":"2026-08-06T16:46:02.127936Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.127936Z"},"links":{"cited_paper":"/paper/2406.01574","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:e1231c37a5e99ed814ddf8943f0ecff75fa6355d483e099ba93c7a62477ce23f","observation_id":"a242dc43-64ca-404a-a3e3-fadb42c1a74e","resolution":{"observed_at":"2026-08-06T16:46:02.127936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22673","last_updated":"2025-07-17T01:19:22Z","snapshot_observed_at":"2026-08-07T16:29:27.838930Z","submitted_at":"2025-03-28T17:58:33Z","title":"ActionStudio: A Lightweight Framework for Data and Training of Large Action Models","version":3},"cited_work":{"arxiv_id":"2503.22673","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.22673","snapshot_observed_at":"2026-08-06T16:46:03.048121Z","title":"ActionStudio: A Lightweight Framework for Data and Training of Large Action Models","venue":"cs.AI","work_id":"c6bba2a7-2afc-414e-b7bf-5545fab949ff","year":2025},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.199468Z"},"links":{"cited_paper":"/paper/2503.22673","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:7919cae9fe2a786f46865059334db4e95e3bfed046645a43f827fecf87d3dc99","observation_id":"c607c54f-dc16-4cb5-bf78-d021f4fff877","resolution":{"observed_at":"2026-08-06T16:46:03.088040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03215","last_updated":"2024-09-05T03:22:22Z","snapshot_observed_at":"2026-07-06T19:10:48.519252Z","submitted_at":"2024-09-05T03:22:22Z","title":"xLAM: A Family of Large Action Models to Empower AI Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03215","snapshot_observed_at":"2026-08-06T16:46:02.276368Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.276368Z"},"links":{"cited_paper":"/paper/2409.03215","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:d7b5174c05cdc58d2835794eb8d2f56c65026f403f4ceb98639d0e8d5a5eaaf0","observation_id":"380140d5-000a-4b40-ba1e-8f10e9c4d317","resolution":{"observed_at":"2026-08-06T16:46:02.276368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10172","last_updated":"2024-02-05T08:10:52Z","snapshot_observed_at":"2026-07-06T15:55:59.949673Z","submitted_at":"2023-07-19T17:57:53Z","title":"DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI","version":3},"cited_work":{"arxiv_id":"2307.10172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.10172","snapshot_observed_at":"2026-08-06T16:46:02.895404Z","title":"DialogStudio: Towards Richest and Most Diverse Unified Dataset Collection for Conversational AI","venue":"cs.CL","work_id":"19af067d-338d-444b-9455-2f9e40f4c976","year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.333562Z"},"links":{"cited_paper":"/paper/2307.10172","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:e4283010ba50bd1b6e4d04509ecad1a207559158d9a5ef18b4f5a906e12a99aa","observation_id":"dbf4f137-366a-4b92-904e-d90b7f7e9806","resolution":{"observed_at":"2026-08-06T16:46:02.956374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09340","last_updated":"2024-09-27T17:43:31Z","snapshot_observed_at":"2026-07-06T18:14:41.996656Z","submitted_at":"2024-05-15T13:43:57Z","title":"Laser Printing of Silver and Silver Oxide","version":4},"cited_work":{"arxiv_id":"2405.09340","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.09340","snapshot_observed_at":"2026-08-06T16:46:02.783021Z","title":"Laser Printing of Silver and Silver Oxide","venue":"physics.optics","work_id":"1872bd8b-02f0-46e1-b30d-be8f6e176fee","year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.418806Z"},"links":{"cited_paper":"/paper/2405.09340","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:997f495ac438db6b29ea396bd5b58024cef423761afdea9288587d258678d56f","observation_id":"247dbebb-307f-41a6-a3ad-76cf635dbe64","resolution":{"observed_at":"2026-08-06T16:46:02.814754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-06T16:46:02.488733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.488733Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:4a046c643ec853d4d73b476f24a4ed3f832209f90cf1d79903e89c71d338e72d","observation_id":"bdbe1501-a723-46ee-a294-bc95b9e765c1","resolution":{"observed_at":"2026-08-06T16:46:02.488733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T16:46:02.574065Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.574065Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:8eb75492a69d961ad578a324c2bb1f418bebcfd546fe6515b7c41c65669ff7ed","observation_id":"ccbb6752-8574-4506-9e62-d15cdad40e39","resolution":{"observed_at":"2026-08-06T16:46:02.574065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09844","last_updated":"2024-06-14T08:51:31Z","snapshot_observed_at":"2026-07-06T18:30:50.693663Z","submitted_at":"2024-06-14T08:51:31Z","title":"Vec-Tok-VC+: Residual-enhanced Robust Zero-shot Voice Conversion with Progressive Constraints in a Dual-mode Training Strategy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09844","snapshot_observed_at":"2026-08-06T16:46:02.635196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T16:46:02.635196Z"},"links":{"cited_paper":"/paper/2406.09844","citing_paper":"/paper/2507.12806"},"observation_digest":"sha256:25be18b8897dbd285284dc514f171057ff0c7cc60b660a64aaaa608dcc3c0e92","observation_id":"f51c148d-fa70-4e16-babb-41243255782c","resolution":{"observed_at":"2026-08-06T16:46:02.635196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12806","last_updated":"2025-08-01T22:37:16Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T22:42:00.146049Z","submitted_at":"2025-07-17T05:46:27Z","title":"MCPEval: Automatic MCP-based Deep Evaluation for AI Agent Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":9,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2507.12806."}