{"as_of":"2026-08-07T19:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:55a0cc2e5ac4ca89c163dd7d531e5b4f2bd21a3e44a9311f2036e76b4f9f96d4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:07:08.786395Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":16,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2505.09999","last_updated":"2026-05-11T03:41:00Z","snapshot_observed_at":"2026-07-30T05:05:51.180006Z","submitted_at":"2025-05-15T06:24:08Z","title":"ServeGen: Workload Characterization and Generation of Large Language Model Serving in Production","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T15:42:05.266854Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2505.09999"},"observation_digest":"sha256:5af16fb8c14cf35f469ee144ce257d0e8d79adc0a1cf927a1e5004442038a601","observation_id":"dd0d9f5f-27ce-4fbb-81b7-6f27b5f70e55","resolution":{"observed_at":"2026-05-22T15:44:58.119606Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-07T11:07:08.786395Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06363","last_updated":"2025-06-03T21:11:56Z","snapshot_observed_at":"2026-08-07T11:01:41.415295Z","submitted_at":"2025-06-03T21:11:56Z","title":"ChemGraph: An Agentic Framework for Computational Chemistry Workflows","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T11:07:08.786395Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2506.06363"},"observation_digest":"sha256:4c77166a0f814803744d1721d623936dce43f31978e0dfa6b98d84d49086fd0b","observation_id":"dbc2158c-70d8-4b05-a080-05b7abb71823","resolution":{"observed_at":"2026-08-07T11:07:08.786395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-07T04:52:00.986893Z","title":"Mint: Evaluating llms in multi-turn interaction with tools and language feedback.arXiv preprint arXiv:2309.10691, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09420","last_updated":"2025-06-11T06:08:13Z","snapshot_observed_at":"2026-08-07T04:46:13.652921Z","submitted_at":"2025-06-11T06:08:13Z","title":"A Call for Collaborative Intelligence: Why Human-Agent Systems Should Precede AI Autonomy","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:52:00.986893Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2506.09420"},"observation_digest":"sha256:28b1f3f577e52b7534e8d468b8a0564d53268e6b80895262780acb28b182582e","observation_id":"fe819c0f-4e05-4e74-b792-821941c5a143","resolution":{"observed_at":"2026-08-07T04:52:00.986893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-07T06:00:19.896513Z","title":"Mint: Evaluating llms in multi- turn interaction with tools and language feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11102","last_updated":"2025-06-06T17:52:18Z","snapshot_observed_at":"2026-08-07T05:54:56.593167Z","submitted_at":"2025-06-06T17:52:18Z","title":"Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey","version":1},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:19.896513Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2506.11102"},"observation_digest":"sha256:c912764269f5e196aa145401c2c5e9dded0dd234f945ec781250348b52c7ffd5","observation_id":"be19d469-391a-47f3-8e42-b4a525f8d81e","resolution":{"observed_at":"2026-08-07T06:00:19.896513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-07T00:53:15.549331Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17282","last_updated":"2025-06-14T17:07:06Z","snapshot_observed_at":"2026-08-07T00:43:24.699108Z","submitted_at":"2025-06-14T17:07:06Z","title":"Automating Financial Statement Audits with Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:53:15.549331Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2506.17282"},"observation_digest":"sha256:919a56a4d579f6ffafccb7357183e9248439c429f5e12d43a2849dae5a397218","observation_id":"27374b34-1684-49b9-9c3e-101ca3db1365","resolution":{"observed_at":"2026-08-07T00:53:15.549331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-06T17:11:33.977624Z","title":"Mint: Evaluating llms in multi-turn interaction with tools and language feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11527","last_updated":"2025-07-15T17:56:04Z","snapshot_observed_at":"2026-08-07T07:31:40.303264Z","submitted_at":"2025-07-15T17:56:04Z","title":"DrafterBench: Benchmarking Large Language Models for Tasks Automation in Civil Engineering","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T17:11:33.977624Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2507.11527"},"observation_digest":"sha256:7ee547704eea1406c426ba88b37da950d36a5f4e51f21f18748bb2c53de1c074","observation_id":"1b717073-e197-45fc-ad3f-e3a5e158c86c","resolution":{"observed_at":"2026-08-06T17:11:33.977624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-06T16:14:04.918820Z","title":"Mint: Evaluating llms in multi-turn interaction with tools and language feedback, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14295","last_updated":"2025-08-22T16:49:10Z","snapshot_observed_at":"2026-08-07T14:03:43.498386Z","submitted_at":"2025-07-18T18:07:38Z","title":"A Simple \"Try Again\" Can Elicit Multi-Turn LLM Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T16:14:04.918820Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2507.14295"},"observation_digest":"sha256:3ecf6b4ddbb17ffa5da3bf236b2c602518e0fabb25204b563831d5fb1c486927","observation_id":"7e0cb956-51fa-47cc-be48-1410d9573aba","resolution":{"observed_at":"2026-08-06T16:14:04.918820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2509.19185","last_updated":"2026-04-02T22:22:56Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T16:02:09Z","title":"An Empirical Study of Testing Practices in Open Source AI Agent Frameworks and Agentic Applications","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T14:12:08.776876Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2509.19185"},"observation_digest":"sha256:cd19a27a88f5ffeb41e690121733b5792d8a2dfc4139357479b71de30aa76e7b","observation_id":"2dce9817-e5db-4adb-a203-2e56ebe70506","resolution":{"observed_at":"2026-05-18T14:12:39.816366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2511.02230","last_updated":"2026-05-25T23:34:23Z","snapshot_observed_at":"2026-08-04T00:19:14.332924Z","submitted_at":"2025-11-04T03:43:05Z","title":"Continuum: Efficient and Robust Multi-Turn LLM Agent Scheduling with KV Cache Time-to-Live","version":5},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-18T01:58:23.234348Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2511.02230"},"observation_digest":"sha256:271d786e6f747848b465237899d50a20ec84c73e3f9d050e40fce06e4991c75a","observation_id":"54ca4c07-5857-4c29-adaa-0985a18cbca1","resolution":{"observed_at":"2026-05-18T02:00:39.797394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-04T00:19:21.129190Z","title":"Mint: Evaluating llms in multi-turn interaction with tools and language feedback.arXiv preprint arXiv:2309.10691, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.02230","last_updated":"2026-05-25T23:34:23Z","snapshot_observed_at":"2026-08-04T00:19:14.332924Z","submitted_at":"2025-11-04T03:43:05Z","title":"Continuum: Efficient and Robust Multi-Turn LLM Agent Scheduling with KV Cache Time-to-Live","version":6},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T00:19:21.129190Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2511.02230"},"observation_digest":"sha256:eb83c67e1ac83c41e4fe28f6723b58d8553f8a8466cf41211a8e81498ef5319b","observation_id":"f4751383-d045-463c-be3b-321ec00feebb","resolution":{"observed_at":"2026-08-04T00:19:21.129190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-03T11:44:07.135108Z","title":"Yifan Wei, Xiaoyan Yu, Yixuan Weng, Tengfei Pan, Angsheng Li, and Li Du","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.05366","last_updated":"2026-06-28T19:14:17Z","snapshot_observed_at":"2026-08-03T11:43:55.595172Z","submitted_at":"2026-01-08T20:44:28Z","title":"Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T11:44:07.135108Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2601.05366"},"observation_digest":"sha256:8b600185b28abaf294b286ad7fac2fb5a034c8a64dedaa9f6d3d549fc8eb43b9","observation_id":"0164b675-c62d-424f-afc9-63de5f2c3494","resolution":{"observed_at":"2026-08-03T11:44:07.135108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-03T10:30:41.526303Z","title":"et al.: Mint: Evaluating llms in multi-turn interaction with tools and language feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.09822","last_updated":"2026-01-19T19:10:53Z","snapshot_observed_at":"2026-08-07T09:19:36.604857Z","submitted_at":"2026-01-14T19:28:30Z","title":"LLM-Based Agentic Systems for Software Engineering: Challenges and Opportunities","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T10:30:41.526303Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2601.09822"},"observation_digest":"sha256:12b786f514ad36ba0066dd787f608fbdf06159a59e914e3d0fa7456296eb42a0","observation_id":"a29eb7da-c3fa-4131-9675-0118d26be51c","resolution":{"observed_at":"2026-08-03T10:30:41.526303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2604.06392","last_updated":"2026-04-07T19:22:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-07T19:22:20Z","title":"Qualixar OS: A Universal Operating System for AI Agent Orchestration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:44:25.389675Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2604.06392"},"observation_digest":"sha256:f3040d221ebdca727804e6c81ea44bbb4037b9c38c06dee8d5f72281037ea0a4","observation_id":"d32cf886-8fce-4c05-b174-d866c7b8c931","resolution":{"observed_at":"2026-05-11T00:00:55.622769Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2604.23051","last_updated":"2026-04-24T22:44:21Z","snapshot_observed_at":"2026-07-06T23:09:19.041332Z","submitted_at":"2026-04-24T22:44:21Z","title":"Evaluating Temporal Consistency in Multi-Turn Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-08T11:37:10.330674Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2604.23051"},"observation_digest":"sha256:9257e44a18f79589a6e6fad3a9caf481bf2b41937c6575ded486e81c5895ec3e","observation_id":"f05026b1-8666-411f-8889-4c4da5e839d3","resolution":{"observed_at":"2026-05-11T19:36:12.942416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.00334","last_updated":"2026-05-01T01:25:56Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T01:25:56Z","title":"AgentFloor: How Far Up the tool use Ladder Can Small Open-Weight Models Go?","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-09T20:09:11.566825Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.00334"},"observation_digest":"sha256:d6c879607874c9f9027d223b6e4751fc5c711e0d4702355aefeedc7aec8ac1d8","observation_id":"fc8facb9-335a-4d59-a160-5a2a4d7691a5","resolution":{"observed_at":"2026-05-11T15:21:10.587173Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.00737","last_updated":"2026-08-06T13:58:03Z","snapshot_observed_at":"2026-08-07T19:26:48.217315Z","submitted_at":"2026-05-01T15:38:13Z","title":"To Call or Not to Call: A Framework to Assess and Optimize LLM Tool Calling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-09T19:32:57.054584Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.00737"},"observation_digest":"sha256:133d7efd7a3042b5905ac6a7da1253d7b675aff83a682769e23a3ebb9b5d4e5b","observation_id":"29dad227-b50f-4304-88af-6fe780563325","resolution":{"observed_at":"2026-05-11T15:36:10.316387Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.01920","last_updated":"2026-05-03T15:02:44Z","snapshot_observed_at":"2026-08-03T04:20:42.175838Z","submitted_at":"2026-05-03T15:02:44Z","title":"A Language for Describing Agentic LLM Contexts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T17:18:16.256307Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.01920"},"observation_digest":"sha256:067a11cdd70e73cadc3142e31432fadb60a6612e59260049299855f7ea58b56d","observation_id":"3ac429c7-71f4-4082-8f33-8e3c45480718","resolution":{"observed_at":"2026-05-11T16:21:09.182239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.10516","last_updated":"2026-05-11T13:06:24Z","snapshot_observed_at":"2026-07-06T23:22:28.318343Z","submitted_at":"2026-05-11T13:06:24Z","title":"Consistency as a Testable Property: Statistical Methods to Evaluate AI Agent Reliability","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T04:41:15.286881Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.10516"},"observation_digest":"sha256:ddaac93c71c135f245108fdc3bcc773b534ef6febe7a97e3cc4de76474a604a3","observation_id":"077c04f4-2078-4930-8337-d5cb9dfc6c8d","resolution":{"observed_at":"2026-05-12T04:41:21.833327Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.16508","last_updated":"2026-05-15T18:05:21Z","snapshot_observed_at":"2026-08-03T01:50:34.102829Z","submitted_at":"2026-05-15T18:05:21Z","title":"The Scaling Laws of Skills in LLM Agent Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T18:10:08.737710Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.16508"},"observation_digest":"sha256:9cc043f47b6977fcbb0641ce94357d52dc901487d001a9e5f06df47c8fe89ec2","observation_id":"310ebe67-b272-46ba-a4de-a4da00752f82","resolution":{"observed_at":"2026-05-20T18:13:37.568810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.17829","last_updated":"2026-05-18T04:03:18Z","snapshot_observed_at":"2026-08-05T06:31:55.615676Z","submitted_at":"2026-05-18T04:03:18Z","title":"Interactive Evaluation Requires a Design Science","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T10:55:08.135630Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.17829"},"observation_digest":"sha256:f662ab4e4f5dab904d858f96d44dc12513a88803f0dbb2b01ca51d43c5a53251","observation_id":"23514e88-d818-4ff8-81da-582867fa3c7a","resolution":{"observed_at":"2026-05-20T10:58:14.000188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.18630","last_updated":"2026-05-18T16:34:45Z","snapshot_observed_at":"2026-07-06T23:29:29.105126Z","submitted_at":"2026-05-18T16:34:45Z","title":"SCICONVBENCH: Benchmarking LLMs on Multi-Turn Clarification for Task Formulation in Computational Science","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-20T10:36:09.724234Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.18630"},"observation_digest":"sha256:038c290d4618d67314a85dde10c3f32750596f467d7c4c75d86590791f29c749","observation_id":"90999811-e646-45b4-a6bc-ed75fca53284","resolution":{"observed_at":"2026-05-20T10:38:12.096119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2605.26788","last_updated":"2026-05-26T10:00:42Z","snapshot_observed_at":"2026-07-06T23:36:34.652096Z","submitted_at":"2026-05-26T10:00:42Z","title":"SeDT: Sentence-Transformer Decision-Transformer Conditioning for Multi-Turn Conversation Reliability","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T18:45:40.697579Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2605.26788"},"observation_digest":"sha256:1f61479d2af79a0fd72c1b3c35358cefd9ffb46a1b6328dd7e2b0699f9bb3453","observation_id":"63860cd3-a857-4659-a905-39e5599c0da3","resolution":{"observed_at":"2026-06-29T18:53:51.659118Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2606.19613","last_updated":"2026-06-17T21:36:09Z","snapshot_observed_at":"2026-08-07T13:16:30.354063Z","submitted_at":"2026-06-17T21:36:09Z","title":"StaminaBench: Stress-Testing Coding Agents over 100 Interaction Turns","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-26T19:47:59.090249Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2606.19613"},"observation_digest":"sha256:1988ad4b4c464194328262c68d58692e42737176f8729f840156e1efaf2a54b2","observation_id":"6cb1c69f-d869-4e53-bca4-624b15c3ff28","resolution":{"observed_at":"2026-07-04T02:19:23.870272Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":"2309.10691","doi":"10.48550/arxiv.2309.10691","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MINT: Evaluating LLMs in multi-turn interaction with tools and language feedback","venue":"arXiv (Cornell University)","work_id":"779a6fb4-3e49-40f8-a8b8-f57cbc3db5c3","year":2024},"citing_paper":{"arxiv_id":"2606.30774","last_updated":"2026-06-29T18:06:36Z","snapshot_observed_at":"2026-07-07T00:04:34.491408Z","submitted_at":"2026-06-29T18:06:36Z","title":"What Drives Interactive Improvement from Feedback?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T02:36:20.649687Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2606.30774"},"observation_digest":"sha256:2f13f12f70ea894443c2d88fa15f271be89d4f0e3265b2b12828779d08959dab","observation_id":"3fa3b650-be81-43d9-b8f2-967f5167901d","resolution":{"observed_at":"2026-07-01T12:05:43.465485Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T23:23:35.799178+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10691","snapshot_observed_at":"2026-07-31T19:54:08.546745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28033","last_updated":"2026-07-30T11:17:27Z","snapshot_observed_at":"2026-08-05T02:42:56.093326Z","submitted_at":"2026-07-30T11:17:27Z","title":"DataClawEval: A Benchmark for Data Engineering Agents in Real Industrial Harness","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T19:54:08.546745Z"},"links":{"cited_paper":"/paper/2309.10691","citing_paper":"/paper/2607.28033"},"observation_digest":"sha256:1e4c9254143fb8c22f4fa075f21de7a9e57ea15193896ba067a7e2c829d2761d","observation_id":"7761b0a8-c03b-43d6-9ee7-f924f4de7fff","resolution":{"observed_at":"2026-07-31T19:54:08.546745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2309.10691/citation-record","integrity":"/paper/2309.10691/integrity","json":"/paper/2309.10691/citation-record.json","paper":"/paper/2309.10691"},"outbound":[],"paper":{"arxiv_id":"2309.10691","last_updated":"2024-03-12T15:53:06Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T02:23:17.954207Z","submitted_at":"2023-09-19T15:25:42Z","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 25 inbound Pith citation observations for arXiv:2309.10691."}