{"as_of":"2026-08-10T01:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18a59d651c1b156fbdc71ac2ac0fd5f1b5b1ea6ddbd9586cd596847e3b6e40e7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:58:39.391646Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:49:18.497365Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-08T21:58:39.391646Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04686","last_updated":"2025-06-18T03:24:18Z","snapshot_observed_at":"2026-08-08T21:49:25.291616Z","submitted_at":"2025-02-07T06:19:55Z","title":"Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T21:58:39.391646Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2502.04686"},"observation_digest":"sha256:55ff62a64571c9829b810c30320b9ec57f7a18dcaf671bbeb82e05c13b9a996c","observation_id":"a0595463-d9c1-42c6-8e6d-42b7648a6a6f","resolution":{"observed_at":"2026-08-08T21:58:39.391646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-07T22:50:32.949249Z","title":"Werewolf arena: A case study in llm evaluation via social deduction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09053","last_updated":"2025-08-05T02:23:31Z","snapshot_observed_at":"2026-08-08T10:12:47.586452Z","submitted_at":"2025-02-13T08:08:27Z","title":"Game Theory Meets Large Language Models: A Systematic Survey with Taxonomy and New Frontiers","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T22:50:32.949249Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2502.09053"},"observation_digest":"sha256:c3ba519edec5125bca4ae67dbf3c4680d167e67a696b6b4b216c3e42e42c1916","observation_id":"b354bf91-0a7a-4a52-beff-d7b843a97177","resolution":{"observed_at":"2026-08-07T22:50:32.949249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-07T14:02:22.412122Z","title":"Werewolf are na: A case study in llm evaluation via social deduction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20120","last_updated":"2025-05-26T15:22:04Z","snapshot_observed_at":"2026-08-09T05:33:18.875561Z","submitted_at":"2025-05-26T15:22:04Z","title":"Agents Require Metacognitive and Strategic Reasoning to Succeed in the Coming Labor Markets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:22.412122Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2505.20120"},"observation_digest":"sha256:7b3becdf1c49c49baa3146868b025feb854f852dc763bfe46b8821d4d5fb063c","observation_id":"cc9f7743-f87c-4dd4-92b1-1cfc14760251","resolution":{"observed_at":"2026-08-07T14:02:22.412122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-07T12:45:15.845155Z","title":"Werewolf arena: A case study in llm evaluation via social deduction.arXiv preprint arXiv:2407.13943, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23713","last_updated":"2025-05-29T17:47:36Z","snapshot_observed_at":"2026-08-07T22:01:03.677076Z","submitted_at":"2025-05-29T17:47:36Z","title":"SocialMaze: A Benchmark for Evaluating Social Reasoning in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:45:15.845155Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2505.23713"},"observation_digest":"sha256:1d4a9ba8ed6f28c7b8aa940e46eb9062247b88d54a69a375b61da86400226366","observation_id":"6df2bdba-089d-4aee-bafa-a3f3e4da6171","resolution":{"observed_at":"2026-08-07T12:45:15.845155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-07T10:51:57.923142Z","title":"Werewolf arena: A case study in llm evaluation via social deduction.arXiv preprint arXiv:2407.13943,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04098","last_updated":"2025-06-10T13:14:14Z","snapshot_observed_at":"2026-08-09T13:12:42.388209Z","submitted_at":"2025-06-04T15:55:27Z","title":"TextAtari: 100K Frames Game Playing with Language Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:51:57.923142Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2506.04098"},"observation_digest":"sha256:6613413720c786586251fec3f7d7b081e9e89146ac533b4ff37673f5afb7225b","observation_id":"724b08bb-f7b8-44c3-a214-03db4ff78204","resolution":{"observed_at":"2026-08-07T10:51:57.923142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-06T16:42:43.264423Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12732","last_updated":"2025-07-17T02:27:45Z","snapshot_observed_at":"2026-08-09T19:30:36.508903Z","submitted_at":"2025-07-17T02:27:45Z","title":"Strategy Adaptation in Large Language Model Werewolf Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T16:42:43.264423Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2507.12732"},"observation_digest":"sha256:b5bc6fd20b13f5baec7d88234a92ffb4a53411dc03c17a020422e7dd9cf8ee93","observation_id":"3be38aa0-8869-492d-812c-2af4af6b75b7","resolution":{"observed_at":"2026-08-06T16:42:43.264423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2509.23023","last_updated":"2026-05-14T13:52:45Z","snapshot_observed_at":"2026-08-03T02:05:46.573077Z","submitted_at":"2025-09-27T00:40:19Z","title":"Deceive, Detect, and Disclose: Large Language Models Play Mini-Mafia","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-18T13:25:17.313704Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2509.23023"},"observation_digest":"sha256:8d74f69135725227cc0038a5b3301741f93ac8da7deff994a5f9d1558e458b29","observation_id":"7eeaeb2a-9457-43d6-85e2-6642c708532a","resolution":{"observed_at":"2026-05-18T13:26:24.820227Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2604.17989","last_updated":"2026-04-20T09:12:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T09:12:47Z","title":"AIT Academy: Cultivating the Complete Agent with a Confucian Three-Domain Curriculum","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T05:08:54.560648Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2604.17989"},"observation_digest":"sha256:a0306cd68ebccb22b2c053276eeb0562a836e9b402d2e4f3a93ab69ff6d6a49b","observation_id":"14bb5245-6fcd-4294-b7f8-0e5807abde3d","resolution":{"observed_at":"2026-05-10T09:43:49.911579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2605.09965","last_updated":"2026-05-12T15:54:46Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T04:16:41Z","title":"Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T03:25:24.844859Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2605.09965"},"observation_digest":"sha256:66be016fffb2fd8b64bfda91b7d074ab2a0aeab379f7d4e4f4f5a9dc6eedc8eb","observation_id":"41bb56e2-2d5c-40f1-b85f-5f907eb5614c","resolution":{"observed_at":"2026-05-12T03:26:19.123141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2605.09965","last_updated":"2026-05-12T15:54:46Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T04:16:41Z","title":"Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T06:44:28.552513Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2605.09965"},"observation_digest":"sha256:395c9da8e62ce6944badc346bdd678ea7de50265915468769207eb9f39a9e78d","observation_id":"d4372387-bfcd-4f7f-a16a-7ad8176b37e7","resolution":{"observed_at":"2026-05-13T06:47:26.904795Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2605.29512","last_updated":"2026-05-28T07:33:47Z","snapshot_observed_at":"2026-07-06T23:38:56.014434Z","submitted_at":"2026-05-28T07:33:47Z","title":"MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T07:15:27.939886Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2605.29512"},"observation_digest":"sha256:8f46a9fb5f22b40c506352c4a837f2ea2703a75251d94cc80f03ad6543c2045b","observation_id":"9d9b41be-bcdb-4364-a6c3-024f314de6cf","resolution":{"observed_at":"2026-06-29T07:23:13.222505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2606.13310","last_updated":"2026-06-11T13:07:02Z","snapshot_observed_at":"2026-08-05T04:26:49.130444Z","submitted_at":"2026-06-11T13:07:02Z","title":"RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T06:34:39.457798Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2606.13310"},"observation_digest":"sha256:49fd70942b96694a37c4b1d18bed43fbaffaac22ef8a9f34a6b7eb13467968b5","observation_id":"45e7a251-a33f-4ef9-82d8-9dec8bf25823","resolution":{"observed_at":"2026-07-03T15:18:33.728065Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2606.19308","last_updated":"2026-06-17T17:31:06Z","snapshot_observed_at":"2026-08-04T23:52:08.389322Z","submitted_at":"2026-06-17T17:31:06Z","title":"Enhancing Decision-Making with Large Language Models through Multi-Agent Fictitious Play","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T20:57:49.840546Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2606.19308"},"observation_digest":"sha256:8271030cb801354ac1c9901b1e773e389d82b5623b8d663989aad3e30e43c80a","observation_id":"62b9d302-6e6f-4bc0-a0b9-8a6ae95a92a3","resolution":{"observed_at":"2026-07-04T00:49:18.499911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2606.30649","last_updated":"2026-06-13T12:35:46Z","snapshot_observed_at":"2026-08-07T06:30:50.821622Z","submitted_at":"2026-06-13T12:35:46Z","title":"Thinking Out Loud: Real-Time Deception Monitoring in Asymmetric LLM Negotiations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T07:11:25.568064Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2606.30649"},"observation_digest":"sha256:5707a19807e402b09c62e50c3ad508ce67d625cee021ec9aaf125f35ddacfe68","observation_id":"4c68c23d-7cae-4249-944a-47e68d77ebdc","resolution":{"observed_at":"2026-07-01T08:45:35.459536Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":"2407.13943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-04T00:49:18.497365Z","title":"Werewolf arena: A case study in llm evaluation via social deduction","venue":null,"work_id":"fbd66d3f-66bc-4206-927d-823093ae3fa7","year":2024},"citing_paper":{"arxiv_id":"2606.31916","last_updated":"2026-06-30T16:22:12Z","snapshot_observed_at":"2026-08-02T10:24:05.379334Z","submitted_at":"2026-06-30T16:22:12Z","title":"Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-07-01T05:40:54.002702Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2606.31916"},"observation_digest":"sha256:ef118c65d4422501f0141b37976beea16def560beeeb46fd6169ac237897e913","observation_id":"5b6be818-7b78-48d2-aa8f-de906eedda25","resolution":{"observed_at":"2026-07-01T10:15:44.661711Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-14T10:15:59.479435Z","title":"Werewolf Arena: A Case Study in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10645","last_updated":"2026-07-18T17:54:54Z","snapshot_observed_at":"2026-08-08T07:16:34.332077Z","submitted_at":"2026-07-12T08:20:52Z","title":"MafiaScope: Non-Invasive, Time-Resolved Belief Probing for LLM Agents in Social Deduction Games","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-14T10:15:59.479435Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2607.10645"},"observation_digest":"sha256:3e775e321c6e062d760e32620a3bbf0613a0d4faa8b997aa30411760bff79466","observation_id":"fd43ebee-2b79-4cf7-a707-d86854e5e49e","resolution":{"observed_at":"2026-07-14T10:15:59.479435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-02T07:14:59.839689Z","title":"Werewolf Arena: A Case Study in","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10645","last_updated":"2026-07-18T17:54:54Z","snapshot_observed_at":"2026-08-08T07:16:34.332077Z","submitted_at":"2026-07-12T08:20:52Z","title":"MafiaScope: Non-Invasive, Time-Resolved Belief Probing for LLM Agents in Social Deduction Games","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T07:14:59.839689Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2607.10645"},"observation_digest":"sha256:88ff1f9c62bcb61ca13e35050409402648bca2bd3a56e58e763cdf768fd0ad85","observation_id":"3b95b283-e15e-4d31-aedd-e5b1279b29c4","resolution":{"observed_at":"2026-08-02T07:14:59.839689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-14T09:04:16.361753Z","title":"Werewolf arena: A case study in llm evaluation via social deduction.arXiv preprint arXiv:2407.13943,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10814","last_updated":"2026-07-12T16:03:30Z","snapshot_observed_at":"2026-08-08T11:06:10.929529Z","submitted_at":"2026-07-12T16:03:30Z","title":"Auditing Belief-Conditioned LLM Agents in Hidden-Information Social Deduction Games","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T09:04:16.361753Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2607.10814"},"observation_digest":"sha256:433ffdda0f858f9913ec9f423626aaabb4341f8f8392e7855ff20fdff27664c4","observation_id":"d3fc3623-1d5b-4819-9f6d-f4875f209f35","resolution":{"observed_at":"2026-07-14T09:04:16.361753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-07-31T08:47:10.407663Z","title":"Werewolf arena: A case study in llm evaluation via social deduc- tion.arXiv preprint arXiv:2407.13943, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24980","last_updated":"2026-07-27T18:32:44Z","snapshot_observed_at":"2026-08-07T23:53:09.495081Z","submitted_at":"2026-07-27T18:32:44Z","title":"Cumulative suspicion and absorption dynamics in an agent-based Mafia game","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T08:47:10.407663Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2607.24980"},"observation_digest":"sha256:f9e635902ef468714272e93a0b85434a3dbae8c7cd50dddc9ee054f4a367e216","observation_id":"bcfcad8a-1b0e-47b7-9701-120e26b7325d","resolution":{"observed_at":"2026-07-31T08:47:10.407663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13943","snapshot_observed_at":"2026-08-01T00:51:15.781283Z","title":"arXiv preprint arXiv:2407.13943 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26120","last_updated":"2026-07-28T17:48:54Z","snapshot_observed_at":"2026-08-07T12:54:18.789385Z","submitted_at":"2026-07-28T17:48:54Z","title":"Even More Deception: Objective Misalignment in Mixed-Motive LLM Multi-Agent Systems","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T00:51:15.781283Z"},"links":{"cited_paper":"/paper/2407.13943","citing_paper":"/paper/2607.26120"},"observation_digest":"sha256:988d545586e41d1889ff4dc4b5532b71c1ad8717ce1d7db69704cdc12d143661","observation_id":"4d19343b-bada-4ef0-933b-0773c7bfddbb","resolution":{"observed_at":"2026-08-01T00:51:15.781283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.13943/citation-record","integrity":"/paper/2407.13943/integrity","json":"/paper/2407.13943/citation-record.json","paper":"/paper/2407.13943"},"outbound":[],"paper":{"arxiv_id":"2407.13943","last_updated":"2024-07-18T23:41:05Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T23:41:05Z","title":"Werewolf Arena: A Case Study in LLM Evaluation via Social Deduction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2407.13943."}