{"as_of":"2026-08-08T17:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9bd7b301f6d4006fffa2d582cdef73c677f39c30466ad5c134b3730287e10cfd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:48:54.886214Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-08T13:48:54.886214Z","title":"Cardiverse: Harnessing LLMs for Novel Card Game Prototyping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07128","last_updated":"2025-09-09T16:20:01Z","snapshot_observed_at":"2026-08-08T13:41:08.095949Z","submitted_at":"2025-02-10T23:47:35Z","title":"Cardiverse: Harnessing LLMs for Novel Card Game Prototyping","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T13:48:54.886214Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2502.07128"},"observation_digest":"sha256:eaab39b326f456c4ff1f9e355354dcbef8ceb1d8e8bdda5a01da10a4f666ab5d","observation_id":"7441e011-4bcb-4002-89b4-389f383a3360","resolution":{"observed_at":"2026-08-08T13:48:54.886214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-07T15:26:56.894546Z","title":"arXiv preprint arXiv:2406.06613 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15146","last_updated":"2025-06-03T09:53:37Z","snapshot_observed_at":"2026-08-07T21:22:21.405277Z","submitted_at":"2025-05-21T06:02:55Z","title":"lmgame-Bench: How Good are LLMs at Playing Games?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:26:56.894546Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2505.15146"},"observation_digest":"sha256:88d5619c9a116c3b490c318352453725640577753d802f9cd52a2dbac5bf9f9e","observation_id":"7e38bd61-6f22-4a25-8709-7c5227b6d909","resolution":{"observed_at":"2026-08-07T15:26:56.894546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-07T14:02:23.124422Z","title":"Gamebench: Evaluating stra tegic reasoning abilities of llm agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20120","last_updated":"2025-05-26T15:22:04Z","snapshot_observed_at":"2026-08-08T12:31:53.572379Z","submitted_at":"2025-05-26T15:22:04Z","title":"Agents Require Metacognitive and Strategic Reasoning to Succeed in the Coming Labor Markets","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:23.124422Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2505.20120"},"observation_digest":"sha256:90071bbfda7b9a49d3b31baee80239fa0c435b99827c1a0283d731263ebe5601","observation_id":"ed3a4d43-6e56-4e31-a840-ac9f9a8909b8","resolution":{"observed_at":"2026-08-07T14:02:23.124422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-07T12:59:11.853620Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23006","last_updated":"2025-05-29T02:30:27Z","snapshot_observed_at":"2026-08-07T12:53:13.414700Z","submitted_at":"2025-05-29T02:30:27Z","title":"A Practical Approach for Building Production-Grade Conversational Agents with Workflow Graphs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:59:11.853620Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2505.23006"},"observation_digest":"sha256:8b877181601ccdeca76054140c5f6848913f9bed185188b259e0b3ed51d961ac","observation_id":"4aeadccc-02a9-4415-961d-6356d4293d6b","resolution":{"observed_at":"2026-08-07T12:59:11.853620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2506.03610","last_updated":"2026-04-14T22:54:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-04T06:40:33Z","title":"Orak: A Foundational Benchmark for Training and Evaluating LLM Agents on Diverse Video Games","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T12:01:42.681135Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2506.03610"},"observation_digest":"sha256:cb15d5c93b62490acc1a4dee1b0fc2544d35fc9a262f001f0415d1cf2a534cb3","observation_id":"0fb2d63d-bee2-4b95-827f-7fc8b15ebf6b","resolution":{"observed_at":"2026-05-19T12:02:16.594562Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-07T06:00:19.529936Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11102","last_updated":"2025-06-06T17:52:18Z","snapshot_observed_at":"2026-08-07T05:54:56.593167Z","submitted_at":"2025-06-06T17:52:18Z","title":"Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:19.529936Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2506.11102"},"observation_digest":"sha256:1ec6057eb7e59904c76a7576dafca8424b4eb7c952909c611bd63010cd27b750","observation_id":"7ce69c54-e46c-48e7-b285-c9b16b59878d","resolution":{"observed_at":"2026-08-07T06:00:19.529936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-07T01:06:45.645947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12012","last_updated":"2025-06-13T17:59:10Z","snapshot_observed_at":"2026-08-07T22:03:22.795316Z","submitted_at":"2025-06-13T17:59:10Z","title":"Tracing LLM Reasoning Processes with Strategic Games: A Framework for Planning, Revision, and Resource-Constrained Decision Making","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T01:06:45.645947Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2506.12012"},"observation_digest":"sha256:88b0efeb4f79f1d2571561bebc60af7e6cb1064958d3c7492effc56d087bb36a","observation_id":"dd1758e4-3553-4f38-9474-fc54f9e18953","resolution":{"observed_at":"2026-08-07T01:06:45.645947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-06T13:46:22.108679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20300","last_updated":"2025-07-30T04:02:44Z","snapshot_observed_at":"2026-08-06T13:46:21.349078Z","submitted_at":"2025-07-27T14:34:29Z","title":"Talking-to-Build: How LLM-Assisted Interface Shapes Player Performance and Experience in Minecraft","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:46:22.108679Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2507.20300"},"observation_digest":"sha256:f41c6cf25c1413efc38ebc24ce24f4a1a932df5e2ffd344b7853c18c29bb55ed","observation_id":"987d5ba4-0bac-4117-82cc-d29d004a9ab9","resolution":{"observed_at":"2026-08-06T13:46:22.108679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-06T12:44:21.535787Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21504","last_updated":"2025-07-29T04:57:02Z","snapshot_observed_at":"2026-08-06T15:35:42.279155Z","submitted_at":"2025-07-29T04:57:02Z","title":"Evaluation and Benchmarking of LLM Agents: A Survey","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:44:21.535787Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2507.21504"},"observation_digest":"sha256:50f084af9f4b1eecaeeddd19994b4b55d7a12f1668432646ee251d7a796d4b5e","observation_id":"fd5e71eb-3fd5-4fc8-bee5-f08a2d330abe","resolution":{"observed_at":"2026-08-06T12:44:21.535787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-06T04:33:42.122192Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03368","last_updated":"2025-08-18T09:53:16Z","snapshot_observed_at":"2026-08-07T21:23:20.919037Z","submitted_at":"2025-08-05T12:15:59Z","title":"Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T04:33:42.122192Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2508.03368"},"observation_digest":"sha256:12a7f061275d80701d77a4ef4f13daa5194b9a3aacc284e72e4329a94362a93e","observation_id":"bcaf3dd5-840a-4fd0-8c7c-6e80e316d631","resolution":{"observed_at":"2026-08-06T04:33:42.122192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T22:07:46.942904Z","title":"J.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07485","last_updated":"2025-08-10T21:07:08Z","snapshot_observed_at":"2026-08-08T15:44:48.200452Z","submitted_at":"2025-08-10T21:07:08Z","title":"Democratizing Diplomacy: A Harness for Evaluating Any Large Language Model on Full-Press Diplomacy","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T22:07:46.942904Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2508.07485"},"observation_digest":"sha256:07dcef5b6c8327c44f5d320f4b312b11087c88b198d2eb22553aa24ba88f226a","observation_id":"884612bd-9a67-48d0-bb05-fbe7a0c7a256","resolution":{"observed_at":"2026-08-05T22:07:46.942904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T19:48:54.647303Z","title":"Costarelli, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.11944","last_updated":"2025-08-16T07:10:26Z","snapshot_observed_at":"2026-08-07T21:59:23.869983Z","submitted_at":"2025-08-16T07:10:26Z","title":"CHBench: A Cognitive Hierarchy Benchmark for Evaluating Strategic Reasoning Capability of LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T19:48:54.647303Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2508.11944"},"observation_digest":"sha256:9f88da854be550accce6e0c64971e408cdb736f0965a664219cdde04f9151661","observation_id":"df416bba-30db-46f5-8714-5221c907d163","resolution":{"observed_at":"2026-08-05T19:48:54.647303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2604.07733","last_updated":"2026-04-09T02:29:20Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T02:29:20Z","title":"CivBench: Progress-Based Evaluation for LLMs' Strategic Decision-Making in Civilization V","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-10T17:59:21.887765Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2604.07733"},"observation_digest":"sha256:48bc60afa7d0c0511b79dbf47748fe1b3b1031fd7d92c53b94ee80bee03c2038","observation_id":"cb706f97-d4a7-4e9b-ac99-8cb0ac403234","resolution":{"observed_at":"2026-05-11T05:41:01.825660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2604.17244","last_updated":"2026-04-19T04:07:05Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T04:07:05Z","title":"DORA Explorer: Improving the Exploration Ability of LLMs Without Training","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-10T06:27:36.922485Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2604.17244"},"observation_digest":"sha256:cba550a38bb7539cbf76f8382fcc0ad99ede7755c6497a2fa839555fd0c5cecc","observation_id":"c1dfd01b-706b-4a48-9568-3b76e9ba769c","resolution":{"observed_at":"2026-05-10T06:31:30.739567Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.12824","last_updated":"2026-05-17T05:34:27Z","snapshot_observed_at":"2026-08-01T05:05:29.007180Z","submitted_at":"2026-05-12T23:46:39Z","title":"Mechanism Plausibility in Generative Agent-Based Modeling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T19:24:53.816091Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.12824"},"observation_digest":"sha256:8f291ddf9ad527214259dd26c9c6c08b6e1f883e264bf630ec1f08c3d436457a","observation_id":"27bd0da9-c555-463f-ac6a-4c3da179efe4","resolution":{"observed_at":"2026-05-14T19:27:50.727667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.12824","last_updated":"2026-05-17T05:34:27Z","snapshot_observed_at":"2026-08-01T05:05:29.007180Z","submitted_at":"2026-05-12T23:46:39Z","title":"Mechanism Plausibility in Generative Agent-Based Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T20:51:54.829821Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.12824"},"observation_digest":"sha256:d24ef19ed355418f6a4be49f521820a4e1fb83df13a06c05e40fc8093c44dc30","observation_id":"d55229ce-b5e4-4106-acec-2f013a55ae0f","resolution":{"observed_at":"2026-05-20T20:53:43.331988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.17510","last_updated":"2026-05-17T15:45:47Z","snapshot_observed_at":"2026-08-03T10:11:52.187850Z","submitted_at":"2026-05-17T15:45:47Z","title":"Scale-Dependent Collective Adaptation in Self-Amending LLM Societies: A Cross-Family Study of Emergent Governance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T22:29:17.058647Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.17510"},"observation_digest":"sha256:73b72b5d7dd28c3356ba6d575143944bf6e517a0d61972ba7aba6b0e6f4396c7","observation_id":"909b3e46-a1c0-4de6-ab6c-9dc215409fdb","resolution":{"observed_at":"2026-05-19T22:32:49.757376Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.17637","last_updated":"2026-05-21T20:02:32Z","snapshot_observed_at":"2026-08-03T12:30:05.317561Z","submitted_at":"2026-05-17T20:07:12Z","title":"WebGameBench: Requirement-to-Application Evaluation for Coding Agents via Browser-Native Games","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T12:24:06.062957Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.17637"},"observation_digest":"sha256:a73a069b3918eabb69c9b2ff98ea6b29499045a6ed2c62fbdaf1c45ed15fe251","observation_id":"829a4d9d-dfbc-4e51-afff-29120182443e","resolution":{"observed_at":"2026-05-20T12:28:17.223104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.17637","last_updated":"2026-05-21T20:02:32Z","snapshot_observed_at":"2026-08-03T12:30:05.317561Z","submitted_at":"2026-05-17T20:07:12Z","title":"WebGameBench: Requirement-to-Application Evaluation for Coding Agents via Browser-Native Games","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T05:45:04.573722Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.17637"},"observation_digest":"sha256:2e2a657b79c311cfd467de186aade87e32cbe1d611ceaecc59da01ef7a69db9e","observation_id":"c77d4480-722c-49e4-a929-3313c6fbfeb0","resolution":{"observed_at":"2026-05-25T05:45:23.209799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.22238","last_updated":"2026-05-21T09:41:16Z","snapshot_observed_at":"2026-08-01T20:38:20.411575Z","submitted_at":"2026-05-21T09:41:16Z","title":"Evaluating Large Language Models as Live Strategic Agents: Provider Performance, Hybrid Decomposition, and Operational Gaps in Timed Risk Play","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-22T05:37:44.982932Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.22238"},"observation_digest":"sha256:82fc8264e4bf5747d62ae59ea56d89a920e79a07c9b2a060815208efa31cfa6b","observation_id":"aaa34980-a9de-4766-81ec-46c655554ffe","resolution":{"observed_at":"2026-05-22T05:41:08.490213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.23238","last_updated":"2026-05-22T05:13:45Z","snapshot_observed_at":"2026-07-31T18:40:46.088078Z","submitted_at":"2026-05-22T05:13:45Z","title":"GENSTRAT: Toward a Science of Strategic Reasoning in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T04:41:35.532363Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.23238"},"observation_digest":"sha256:9654ccbe16f113f829d8d381370b16a12d25fd0c7e2125498160adbcfe52a26d","observation_id":"58c20efe-e896-42ff-bdf7-2572582b4d01","resolution":{"observed_at":"2026-05-25T04:45:20.661900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2605.29512","last_updated":"2026-05-28T07:33:47Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:33:47Z","title":"MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T07:15:27.939886Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2605.29512"},"observation_digest":"sha256:19727640973d3d82e34253c1d8bb7cc73d15f47fdb9d6213bbf35cb0b51cda7c","observation_id":"d3c50d8d-6641-45cc-ac87-441fa5e8ab56","resolution":{"observed_at":"2026-06-29T07:23:13.225042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2606.12191","last_updated":"2026-06-10T15:15:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-10T15:15:01Z","title":"Agentic Environment Engineering for Large Language Models: A Survey of Environment Modeling, Synthesis, Evaluation, and Application","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T09:46:30.702256Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2606.12191"},"observation_digest":"sha256:b3f2e4bc9cb1ecb529b21cab2bc8b32af20c0d4908c960caa3677ad0864fb8c4","observation_id":"1e0264e1-e215-4528-bb99-535cef897dc5","resolution":{"observed_at":"2026-07-03T10:58:02.959131Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2606.19308","last_updated":"2026-06-17T17:31:06Z","snapshot_observed_at":"2026-08-04T23:52:08.389322Z","submitted_at":"2026-06-17T17:31:06Z","title":"Enhancing Decision-Making with Large Language Models through Multi-Agent Fictitious Play","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T20:57:49.840546Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2606.19308"},"observation_digest":"sha256:05496e01b0f793e2c239c2fd009473154aea7d542250208f15c71781ec173e5e","observation_id":"3beae700-2d4a-4407-b34c-757e5a6b5f3b","resolution":{"observed_at":"2026-07-04T00:49:18.400250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2606.19338","last_updated":"2026-06-17T17:59:34Z","snapshot_observed_at":"2026-07-06T23:54:37.596257Z","submitted_at":"2026-06-17T17:59:34Z","title":"Beyond the Current Observation: Evaluating Multimodal Large Language Models in Controllable Non-Markov Games","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T21:17:02.332687Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2606.19338"},"observation_digest":"sha256:36379397c02c38fe5087a4edfc09da36009653da3aa188e9ea396155574b7aec","observation_id":"91441aa4-6d18-4095-86d0-037d058e4b31","resolution":{"observed_at":"2026-07-04T00:19:13.720602Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2606.24391","last_updated":"2026-06-23T10:25:31Z","snapshot_observed_at":"2026-08-06T18:58:31.525238Z","submitted_at":"2026-06-23T10:25:31Z","title":"Age of LLM: A Strategic 1v1 Benchmark for Reasoning, Diplomacy and Reliability of Large Language Models under Fog of War","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T23:49:25.799611Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2606.24391"},"observation_digest":"sha256:6e71f735f581a5e359b0cbad25bfd1ed7094e269366f73e8044e86594659d2fb","observation_id":"d5988a91-cb98-4ff4-9431-648c00f011ac","resolution":{"observed_at":"2026-07-04T17:20:00.168465Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":"2406.06613","doi":"10.48550/arxiv.2406.06613","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gamebench: Evaluating strategic reasoning abilities of llm agents","venue":"arXiv (Cornell University)","work_id":"cdb22e0a-9571-4240-9df5-528000181bf8","year":2024},"citing_paper":{"arxiv_id":"2606.27397","last_updated":"2026-06-24T10:35:31Z","snapshot_observed_at":"2026-08-07T13:04:37.321863Z","submitted_at":"2026-06-24T10:35:31Z","title":"SidConArena: An Environment Evaluating Agents in Open-Ended,Positive-Sum Bargaining Game","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-29T01:56:22.856352Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2606.27397"},"observation_digest":"sha256:a2a054b9b05b2279f1d559221d942b685b681215fc055be2a82d417a7ec2e9c6","observation_id":"41216d83-c78f-4341-8a30-c316306f1c4b","resolution":{"observed_at":"2026-07-01T18:35:58.017825Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06613","snapshot_observed_at":"2026-08-01T10:58:16.650048Z","title":"Gamebench: Evaluating strate- gic reasoning abilities of llm agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22732","last_updated":"2026-07-22T12:10:45Z","snapshot_observed_at":"2026-08-07T05:29:46.171184Z","submitted_at":"2026-07-22T12:10:45Z","title":"Spatial Reasoning in LLM Game Agents: Impact of Causal Context and Multi-Step Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T10:58:16.650048Z"},"links":{"cited_paper":"/paper/2406.06613","citing_paper":"/paper/2607.22732"},"observation_digest":"sha256:61f21fc5ed6672a0025fa615a77bfe0bae863dce048e2232ba1d048b1b7bbea8","observation_id":"8b5f053d-9714-417f-90e5-f34f088869e6","resolution":{"observed_at":"2026-08-01T10:58:16.650048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.06613/citation-record","integrity":"/paper/2406.06613/integrity","json":"/paper/2406.06613/citation-record.json","paper":"/paper/2406.06613"},"outbound":[],"paper":{"arxiv_id":"2406.06613","last_updated":"2024-07-22T14:32:33Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-07T00:28:43Z","title":"GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2406.06613."}