{"as_of":"2026-08-07T12:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bd1b796017e95bc127fc5e6bc10e3ffd111136184d6ebbdba4b3237d14f9d22f","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T22:42:11.459778Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T09:42:05.329537Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30738","snapshot_observed_at":"2026-07-12T09:42:05.329537Z","title":"Gorilla Team","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02577","last_updated":"2026-06-30T21:10:42Z","snapshot_observed_at":"2026-08-07T06:54:53.060230Z","submitted_at":"2026-06-30T21:10:42Z","title":"Benchmarking the Benchmarks: A Validity Audit of Tool-Calling Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T09:42:05.329537Z"},"links":{"cited_paper":"/paper/2605.30738","citing_paper":"/paper/2607.02577"},"observation_digest":"sha256:3f333bb4e5cdb2768805473a5728836799b19cdf2115b010d79ea1dba5c008e5","observation_id":"2ed10347-f040-4e56-9800-24b1fe5ca8d7","resolution":{"observed_at":"2026-07-12T09:42:05.329537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.30738/citation-record","integrity":"/paper/2605.30738/integrity","json":"/paper/2605.30738/citation-record.json","paper":"/paper/2605.30738"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":"2508.10925","doi":"10.3115/1073083.1073135","metadata_source":"pith","pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","venue":"cs.CL","work_id":"178c1f7e-4f19-4392-a45d-45a6dfa88ead","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:7d40e422b52bf45f3ae4cc8da0d3ed2f6ed71b6d1e9990e4c84f489f5eea2643","observation_id":"158a24d5-33b9-4218-b507-6547329b43dd","resolution":{"observed_at":"2026-06-28T22:42:46.143973Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.962081+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08775","last_updated":"2025-05-13T17:53:59Z","snapshot_observed_at":"2026-07-06T21:23:23.760393Z","submitted_at":"2025-05-13T17:53:59Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","version":1},"cited_work":{"arxiv_id":"2505.08775","doi":"10.48550/arxiv.2505.08775","metadata_source":"pith","pith_arxiv_id":"2505.08775","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","venue":"cs.CL","work_id":"5d613c2c-158f-488c-9981-fc9b82a5e093","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2505.08775","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:023771eb6322d296fe9bab17057404fb33e8b2e774b3b8c5bddbe10ef04594ef","observation_id":"ec0e19cc-d42f-4d79-ad99-4bff5dda2520","resolution":{"observed_at":"2026-06-28T22:42:46.104453Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07982","last_updated":"2025-06-09T17:52:18Z","snapshot_observed_at":"2026-07-06T21:39:13.304260Z","submitted_at":"2025-06-09T17:52:18Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","version":1},"cited_work":{"arxiv_id":"2506.07982","doi":"10.48550/arxiv.2506.07982","metadata_source":"pith","pith_arxiv_id":"2506.07982","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment","venue":"cs.AI","work_id":"3a498b1a-455f-4667-b572-c5216c99a89c","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2506.07982","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:fa1c90c21d4b22e91e7b0cedc08712dcde77c6d66d437a851285b9103aab3b6b","observation_id":"36137cd2-46f3-4581-959a-cbf91d22d2db","resolution":{"observed_at":"2026-06-28T22:42:46.123403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.129969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.12851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:26:20.351963Z","title":"Acebench: Who wins the match point in tool usage? arXiv preprint arXiv:2501.12851, 2025 a","venue":null,"work_id":"2593c504-a867-461e-8504-1270698a93d3","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:f49a7a8987b28419cfea3494ab74599d30934aa3a9b0908f1318bdeb7908997a","observation_id":"b03ccce6-64ce-4c26-b971-2d567fae845e","resolution":{"observed_at":"2026-06-28T22:42:46.107975Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13311","doi":"10.48550/arxiv.2509.13311","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards general agentic intelligence via environment scaling.arXiv preprint arXiv:2509.13311","venue":"ArXiv.org","work_id":"156b3dad-8ed9-4fa9-b96b-d126666a80da","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:a30009f493cbb4987421cc76959a375a78aaebc85f01b76143c4ffae7a5b3227","observation_id":"2abfce88-501d-4451-86b0-31dbfc20acb5","resolution":{"observed_at":"2026-06-28T22:42:46.129089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04013","last_updated":"2025-09-04T08:43:27Z","snapshot_observed_at":"2026-08-06T12:43:47.548201Z","submitted_at":"2025-09-04T08:43:27Z","title":"On Robustness and Reliability of Benchmark-Based Evaluation of LLMs","version":1},"cited_work":{"arxiv_id":"2509.04013","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04013","snapshot_observed_at":"2026-06-30T23:45:07.998622Z","title":"On robustness and reliability of benchmark-based evaluation of llms","venue":null,"work_id":"b9028098-f624-4214-ba6e-82cd64cb2a14","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2509.04013","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:251ae18ec2687bb443567b3ca62df65276b0983d6a6b230107cfae14d212c9d5","observation_id":"cacb1980-62da-4e63-b519-bb6e4d88023a","resolution":{"observed_at":"2026-06-28T22:42:46.135066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12138","last_updated":"2026-05-20T13:07:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-20T08:43:49Z","title":"Exploring Code Analysis: Zero-Shot Insights on Syntax and Semantics with LLMs","version":5},"cited_work":{"arxiv_id":"2305.12138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12138","snapshot_observed_at":"2026-07-04T08:39:41.757929Z","title":"Exploring Code Analysis: Zero-Shot Insights on Syntax and Semantics with LLMs","venue":"cs.SE","work_id":"ce180751-e49d-4936-9326-4b794cde4e96","year":2023},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2305.12138","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:b77c033f0295f411494df8c9cbe50a5053d9fb09610d9bd633030055f81ac8ec","observation_id":"ce3c2b12-c59c-4d68-a973-4e6afe0b330d","resolution":{"observed_at":"2026-06-28T22:42:46.141231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15361","last_updated":"2025-08-21T08:43:35Z","snapshot_observed_at":"2026-08-05T17:59:24.133258Z","submitted_at":"2025-08-21T08:43:35Z","title":"A Survey on Large Language Model Benchmarks","version":1},"cited_work":{"arxiv_id":"2508.15361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15361","snapshot_observed_at":"2026-07-04T05:09:36.772485Z","title":"A survey on large language model benchmarks, 2025a","venue":null,"work_id":"8d88765b-fed2-44c6-9298-d24da64f7f20","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2508.15361","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:d02ebefa05b7e2481b85b308527514694fb35c8b7db43a109e06c6e5019a827f","observation_id":"8a497ae1-a56e-4b3c-a908-df4ec41bc80c","resolution":{"observed_at":"2026-06-28T22:42:46.138266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:42:11.459778Z","title":"Ac- cessed: 2025-10-06","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:8fa7e53cd71a4c393ea4522d7f4d0a290b451bbdc50d4c40907e748b2a25d780","observation_id":"4cdd3aa4-380b-452a-8cc8-13d1571aec9e","resolution":{"observed_at":"2026-06-28T22:42:11.459778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":"2307.16789","doi":"10.48550/arxiv.2307.16789","metadata_source":"pith","pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","venue":"cs.AI","work_id":"3c555b48-a4d9-42dd-9fdd-0f6018fbe9cb","year":2023},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:17c037943753415f7a4f68ade0a2fa969b7009cf87485b1b099c4d7bf485d132","observation_id":"14dcb97f-1f27-4e5a-ad39-ba703115f706","resolution":{"observed_at":"2026-06-28T22:42:46.114300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:42:11.459778Z","title":"and Tavor, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:8d04cd7efb40a55804b93a789e8cfef94b5c92009db30e3567d044f228b7a157","observation_id":"6939568b-f256-4022-9292-a412fca46502","resolution":{"observed_at":"2026-06-28T22:42:11.459778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":"2601.03267","doi":"10.48550/arxiv.2601.03267","metadata_source":"pith","pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"OpenAI GPT-5 System Card","venue":"cs.CL","work_id":"ca87689a-0d29-4476-b504-b65dbbb08af4","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:ac603e000053edca8752b26a160119f5142b21466f035512c1f5fdb6e8f91db9","observation_id":"20bb1bdf-8214-4d9c-89ed-5968b9f0ad95","resolution":{"observed_at":"2026-06-28T22:42:46.126021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T00:38:11.458508+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:31736b28c8b904006b11cd89adcc455971c4441f0b078c6d917f3ef2ccfde36d","observation_id":"7db4f82b-7ab8-4fb7-8e5b-9edf78dc28ad","resolution":{"observed_at":"2026-06-28T22:42:46.146810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":"2210.03629","doi":"10.48550/arxiv.2210.03629","metadata_source":"pith","pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","venue":"cs.CL","work_id":"407a2351-25f1-497d-b611-f77d0292a8e6","year":2022},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:511160f22c0e10df4be05a2957a744d746c053de156f6967a339d3ff1931c755","observation_id":"52b1eff2-1d14-4594-998d-684ede8daa10","resolution":{"observed_at":"2026-06-28T22:42:46.131868Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":"2406.12045","doi":"10.48550/arxiv.2406.12045","metadata_source":"pith","pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","venue":"cs.AI","work_id":"6a8d8dc4-0cc0-4052-8109-abbcdcd4a962","year":2024},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:278e1effa3be61d6b600094474669d372ef8b7e0ba42b41365c6b19ac26179b7","observation_id":"48cd2a89-b5e4-41b8-b8b2-86bdd3ccf020","resolution":{"observed_at":"2026-06-28T22:42:46.120670Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06471","last_updated":"2025-08-08T17:21:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-08T17:21:06Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","version":1},"cited_work":{"arxiv_id":"2508.06471","doi":"10.48550/arxiv.2508.06471","metadata_source":"pith","pith_arxiv_id":"2508.06471","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models","venue":"cs.CL","work_id":"5bb4e5d7-985e-431b-bb0d-75576cdc2950","year":2025},"citing_paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T22:42:11.459778Z"},"links":{"cited_paper":"/paper/2508.06471","citing_paper":"/paper/2605.30738"},"observation_digest":"sha256:ff8d3bfedee108eb0591ec404bcc5e4b92f9740ead2674f5faf8379a533a6945","observation_id":"826a85f9-54a9-40f1-8c8c-f40160d5e64b","resolution":{"observed_at":"2026-06-28T22:42:46.149739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T05:23:01.474969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.30738","last_updated":"2026-05-29T02:02:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T17:11:51.059319Z","submitted_at":"2026-05-29T02:02:31Z","title":"MAVEN: Improving Generalization in Agentic Tool Calling"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":2,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 1 inbound Pith citation observation for arXiv:2605.30738."}