{"as_of":"2026-08-18T03:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1c517354570425098869deea5ff2de6219c63253ae5bfc8bbb029fc2d2951ec","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:58:42.280986Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:26:54.346148Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:10:08.747369Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-08-06T23:26:54.346148Z","title":"Monte carlo planning with large language model for text-based game agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18019","last_updated":"2025-07-04T14:29:40Z","snapshot_observed_at":"2026-08-18T01:45:18.804672Z","submitted_at":"2025-06-22T12:59:12Z","title":"Graphs Meet AI Agents: Taxonomy, Progress, and Future Opportunities","version":3},"reference_index":187,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:54.346148Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2506.18019"},"observation_digest":"sha256:d94987a13f823d6046687873d8943604bc105ffee282a2cdd3325a39f48dc370","observation_id":"9c4adaf8-db09-492c-8c1f-ed2f65d465a9","resolution":{"observed_at":"2026-08-06T23:26:54.346148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":"2504.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-07-04T20:10:08.747369Z","title":"arXiv preprint arXiv:2504.16855 , year=","venue":null,"work_id":"f8f89951-d176-4e0c-9aae-8c9ad8cbd5e2","year":2025},"citing_paper":{"arxiv_id":"2604.09442","last_updated":"2026-04-10T15:58:31Z","snapshot_observed_at":"2026-08-15T19:55:16.384984Z","submitted_at":"2026-04-10T15:58:31Z","title":"UIPress: Bringing Optical Token Compression to UI-to-Code Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T17:21:32.024105Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2604.09442"},"observation_digest":"sha256:a9e2731d8dbcfb6ed5d263bcca4ccff80a94524c6399b89a545d363aa5033562","observation_id":"6deae6a7-97d6-490c-9737-0517f8b9f0e8","resolution":{"observed_at":"2026-05-11T07:00:59.502195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":"2504.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-07-04T20:10:08.747369Z","title":"arXiv preprint arXiv:2504.16855 , year=","venue":null,"work_id":"f8f89951-d176-4e0c-9aae-8c9ad8cbd5e2","year":2025},"citing_paper":{"arxiv_id":"2604.18133","last_updated":"2026-04-20T12:00:31Z","snapshot_observed_at":"2026-08-11T20:43:33.503498Z","submitted_at":"2026-04-20T12:00:31Z","title":"Multi-Agent Systems: From Classical Paradigms to Large Foundation Model-Enabled Futures","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-10T04:31:28.242097Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2604.18133"},"observation_digest":"sha256:693334460649a71787d127384cae26cd40f24c59803d84c7011d8a5c41f619f1","observation_id":"29d94bbd-7169-4a71-9c86-05ae5ab5a8f2","resolution":{"observed_at":"2026-05-11T11:51:03.714474Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":"2504.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-07-04T20:10:08.747369Z","title":"arXiv preprint arXiv:2504.16855 , year=","venue":null,"work_id":"f8f89951-d176-4e0c-9aae-8c9ad8cbd5e2","year":2025},"citing_paper":{"arxiv_id":"2605.05191","last_updated":"2026-05-06T17:54:16Z","snapshot_observed_at":"2026-08-16T01:29:50.703615Z","submitted_at":"2026-05-06T17:54:16Z","title":"LongSeeker: Elastic Context Orchestration for Long-Horizon Search Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T17:46:11.207108Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2605.05191"},"observation_digest":"sha256:aa0961546d009a95af309c0c8a3e53c6a3ec93181759c98f170c9a6a371c1010","observation_id":"702c3b56-2c7a-41ff-9b30-4c9f824ac5c3","resolution":{"observed_at":"2026-05-11T17:16:07.309015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":"2504.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-07-04T20:10:08.747369Z","title":"arXiv preprint arXiv:2504.16855 , year=","venue":null,"work_id":"f8f89951-d176-4e0c-9aae-8c9ad8cbd5e2","year":2025},"citing_paper":{"arxiv_id":"2605.12289","last_updated":"2026-05-12T15:47:18Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:47:18Z","title":"PriorZero: Bridging Language Priors and World Models for Decision Making","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T05:25:05.907123Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2605.12289"},"observation_digest":"sha256:32a639738e8abf3ab9f4d656d9a958842ca37f50ec7edcf43222e0b0db71511f","observation_id":"5478b128-463a-499c-b114-43d706664dfe","resolution":{"observed_at":"2026-05-13T05:27:18.575058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"cited_work":{"arxiv_id":"2504.16855","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.16855","snapshot_observed_at":"2026-07-04T20:10:08.747369Z","title":"arXiv preprint arXiv:2504.16855 , year=","venue":null,"work_id":"f8f89951-d176-4e0c-9aae-8c9ad8cbd5e2","year":2025},"citing_paper":{"arxiv_id":"2606.25705","last_updated":"2026-06-24T11:18:01Z","snapshot_observed_at":"2026-08-15T10:43:27.218196Z","submitted_at":"2026-06-24T11:18:01Z","title":"GUI agent: Guided Exploration of User-Sensitive Screens","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-25T20:34:05.239277Z"},"links":{"cited_paper":"/paper/2504.16855","citing_paper":"/paper/2606.25705"},"observation_digest":"sha256:7a89a708e025f4f2b73c0adda1fec1bf0ec59335934552744fa903a697bfafda","observation_id":"f73985d3-5427-4c3f-887e-269cd4ca2d40","resolution":{"observed_at":"2026-07-04T20:10:08.749357Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.16855/citation-record","integrity":"/paper/2504.16855/integrity","json":"/paper/2504.16855/citation-record.json","paper":"/paper/2504.16855"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.07409","last_updated":"2020-06-12T18:24:06Z","snapshot_observed_at":"2026-08-17T17:36:35.643945Z","submitted_at":"2020-06-12T18:24:06Z","title":"How to Avoid Being Eaten by a Grue: Structured Exploration Strategies for Textual Worlds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07409","snapshot_observed_at":"2026-08-16T10:58:41.471848Z","title":"How to avoid being eaten by a grue: Structured exploration strategies for textual worlds","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.471848Z"},"links":{"cited_paper":"/paper/2006.07409","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:06f8744db4c09fb797f4cadf7bcbfd9fccd8287f3741e4fe3f7fa3123c5e1717","observation_id":"ff778810-f747-409e-8bef-9d010d50d7d3","resolution":{"observed_at":"2026-08-16T10:58:41.471848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08470","last_updated":"2022-03-29T11:00:03Z","snapshot_observed_at":"2026-08-18T01:34:48.950671Z","submitted_at":"2021-10-16T04:51:34Z","title":"Case-based Reasoning for Better Generalization in Textual Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08470","snapshot_observed_at":"2026-08-16T10:58:41.478117Z","title":"Case- based reasoning for better generalization in textual reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.478117Z"},"links":{"cited_paper":"/paper/2110.08470","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:f722de39aa745807cd3cbbbdd0f59ec3fa4e7c9aecad50288cce0016f3ed37ca","observation_id":"21f828f2-588e-4c7c-a578-d3d47d608442","resolution":{"observed_at":"2026-08-16T10:58:41.478117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.575742Z","title":"Textworld: A learning environment for text-based games","venue":null,"work_id":"568ba0f2-2b31-42b5-b33a-b76239e65f22","year":2018},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.590449Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:9cd246f712a048e70a1fa092b12edb6df40e8da9637c1fa71a39d4da1450ff08","observation_id":"ee3a5b0f-63ef-48d4-98b8-cfaa9dfc1784","resolution":{"observed_at":"2026-08-16T10:58:43.621518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04254","last_updated":"2024-02-23T15:09:58Z","snapshot_observed_at":"2026-08-16T14:45:18.791931Z","submitted_at":"2023-11-07T12:30:36Z","title":"Everything of Thoughts: Defying the Law of Penrose Triangle for Thought Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04254","snapshot_observed_at":"2026-08-16T10:58:41.795671Z","title":"Everything of thoughts: Defying the law of penrose triangle for thought generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.795671Z"},"links":{"cited_paper":"/paper/2311.04254","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:32fc124ba57313d631aa5aecb661752370f3c99a160272c958f0508e457d8712","observation_id":"80787254-a884-480d-849f-d596b64b8d5b","resolution":{"observed_at":"2026-08-16T10:58:41.795671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02386","last_updated":"2020-10-05T23:09:20Z","snapshot_observed_at":"2026-08-17T17:38:04.337620Z","submitted_at":"2020-10-05T23:09:20Z","title":"Interactive Fiction Game Playing as Multi-Paragraph Reading Comprehension with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2010.02386","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.02386","snapshot_observed_at":"2026-08-16T10:58:42.793762Z","title":"Interactive Fiction Game Playing as Multi-Paragraph Reading Comprehension with Reinforcement Learning","venue":"cs.CL","work_id":"418b5ac2-87f8-48d5-9c25-0a980a5bcdf2","year":2020},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.804280Z"},"links":{"cited_paper":"/paper/2010.02386","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:c61e83e7a7623f60c7dd76f42c1d4b5d1e0822d06377e4e22c1ca660ea57806b","observation_id":"099b7e88-e573-4b7d-ad39-ea6e39b79166","resolution":{"observed_at":"2026-08-16T10:58:42.843248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.04636","last_updated":"2016-06-08T05:58:34Z","snapshot_observed_at":"2026-08-14T22:22:57.695380Z","submitted_at":"2015-11-14T23:30:39Z","title":"Deep Reinforcement Learning with a Natural Language Action Space","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.04636","snapshot_observed_at":"2026-08-16T10:58:41.809175Z","title":"Deep reinforcement learning with a natural language action space","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.809175Z"},"links":{"cited_paper":"/paper/1511.04636","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:9a0059a185ca29ed6d6ee058933b9abef99fc51ac564c6ca5043203932d8d2f7","observation_id":"b292a321-9235-4402-83ee-7468f1ba8276","resolution":{"observed_at":"2026-08-16T10:58:41.809175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.08941","last_updated":"2015-09-11T23:16:13Z","snapshot_observed_at":"2026-08-14T22:42:24.459308Z","submitted_at":"2015-06-30T05:51:11Z","title":"Language Understanding for Text-based Games Using Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.08941","snapshot_observed_at":"2026-08-16T10:58:41.821570Z","title":"Language understanding for text-based games using deep reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.821570Z"},"links":{"cited_paper":"/paper/1506.08941","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:eb57f24d3448c9235a0d3d171eb4819589ce46152444540b397f68c6827cb2b3","observation_id":"ba7f4161-655c-40e7-b08d-3002ebb5e69c","resolution":{"observed_at":"2026-08-16T10:58:41.821570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.acl-short.56","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:42.487418Z","title":"doi: 10.18653/v1/2022.acl-short.56","venue":null,"work_id":"e67f838b-4a9a-4dc9-b8bd-1f546346062e","year":2022},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.957615Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:cf68d7bb043ac84d2247b612cf5ee93a5920db5e49b201267986907e702f15b4","observation_id":"3cef94a7-8688-4c36-86ab-49e460074034","resolution":{"observed_at":"2026-08-16T10:58:42.505736Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-08-13T15:27:25.430393Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-16T10:58:42.028796Z","title":"Alfworld: Aligning text and embodied environments for interactive learning","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.028796Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:46df683a3a796c64c2bc22c2271e07b9288a063432408c7e1a8f794d330e4958","observation_id":"444e21d2-6db1-4318-ac3a-e15f43fa7dca","resolution":{"observed_at":"2026-08-16T10:58:42.028796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09454","last_updated":"2023-10-14T00:07:03Z","snapshot_observed_at":"2026-08-16T14:52:12.426791Z","submitted_at":"2023-10-14T00:07:03Z","title":"LgTS: Dynamic Task Sampling using LLM-generated sub-goals for Reinforcement Learning Agents","version":1},"cited_work":{"arxiv_id":"2310.09454","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.09454","snapshot_observed_at":"2026-08-16T10:58:42.719212Z","title":"LgTS: Dynamic Task Sampling using LLM-generated sub-goals for Reinforcement Learning Agents","venue":"cs.AI","work_id":"f03f07a9-2599-4b28-9032-e77fdc398b1e","year":2023},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.060101Z"},"links":{"cited_paper":"/paper/2310.09454","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:dd1aab02d0c979bdafcb782a6554ec72ddbe00f755d6ebc36e8a0ea48496fa17","observation_id":"ca0757d6-86c9-4911-9f39-c082a24d7333","resolution":{"observed_at":"2026-08-16T10:58:42.723751Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.14239","last_updated":"2021-05-29T07:25:11Z","snapshot_observed_at":"2026-08-16T18:21:16.475267Z","submitted_at":"2021-05-29T07:25:11Z","title":"Simplified Belief-Dependent Reward MCTS Planning with Guaranteed Tree Consistency","version":1},"cited_work":{"arxiv_id":"2105.14239","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.14239","snapshot_observed_at":"2026-08-16T10:58:42.565908Z","title":"Simplified Belief-Dependent Reward MCTS Planning with Guaranteed Tree Consistency","venue":"cs.AI","work_id":"146167be-ecbb-4a30-8f92-8e4ef10db48e","year":2021},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.064659Z"},"links":{"cited_paper":"/paper/2105.14239","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:58f3943263d0e813cf17d5f6fb5946c7c840f89dec16c525febec9c40e6ce607","observation_id":"b6fbcc82-fd56-4b65-87b3-dfbac51c42d4","resolution":{"observed_at":"2026-08-16T10:58:42.636929Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.01251","last_updated":"2022-03-16T01:46:38Z","snapshot_observed_at":"2026-08-16T17:30:19.907373Z","submitted_at":"2022-01-04T17:19:52Z","title":"Multi-Stage Episodic Control for Strategic Exploration in Text Games","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.01251","snapshot_observed_at":"2026-08-16T10:58:42.069518Z","title":"Multi-stage episodic control for strategic exploration in text games","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.069518Z"},"links":{"cited_paper":"/paper/2201.01251","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:fb1113f31df408904ea719bbd8b325f70c922bbe76b868a96d94629b4635ba40","observation_id":"3c8c2c90-00ce-4457-944d-b5a6a6227c20","resolution":{"observed_at":"2026-08-16T10:58:42.069518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-16T10:58:42.074242Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.074242Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:4d00f04e56b57dd6b835fa98df433a9a2fdc85545d2588b8487ebc460b3d93bb","observation_id":"9202a18f-3493-4576-bf55-fd8ad9329ee3","resolution":{"observed_at":"2026-08-16T10:58:42.074242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.436993Z","title":"Generalization in text-based games via hierarchical reinforcement learning","venue":null,"work_id":"517247d7-1b16-4229-a066-34dbaadcaf28","year":2025},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.078430Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:494eafaed95e9148b8e160928266abf503ad2304cbe6b85c4db6dc54eee86ff2","observation_id":"11ba4ba3-f1e2-4850-b1d3-b40e6d62d0b8","resolution":{"observed_at":"2026-08-16T10:58:43.522017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.116","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:42.319110Z","title":"doi: 10.18653/v1/2021.findings-emnlp.116","venue":null,"work_id":"281419a8-f61e-49b4-ba26-a05442960b22","year":2021},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.081743Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:61cf6170652987929f202da36d071b7b87b6e3643b90074b287ac134dfb9f45f","observation_id":"f8b596aa-78d2-4acc-9c88-06d30a9cfec1","resolution":{"observed_at":"2026-08-16T10:58:42.407724Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.424107Z","title":"URL https://aclanthology.org/2022.acl-long.41","venue":null,"work_id":"3f0e09fe-0043-43ee-a526-c1c4a7cd3cf6","year":2022},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.085750Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:d143ee4859aee87d74f1f8c84be5e8fff3af6b72f72de1cfb646f61eafc6b0f5","observation_id":"6717f30d-ac4c-4add-ab36-e423cc4eb871","resolution":{"observed_at":"2026-08-16T10:58:43.428123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:42.089689Z","title":"URL https://aclanthology.org/ 2020.emnlp-main.704","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.089689Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:5e592ad2c38b68be3bb3132f49b279db2bf0d311da689d06e0075fcaf637da37","observation_id":"73c8708e-943a-48fa-920e-b5b8bb39d7bd","resolution":{"observed_at":"2026-08-16T10:58:42.089689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17144","last_updated":"2023-06-01T09:18:01Z","snapshot_observed_at":"2026-08-16T02:27:56.530647Z","submitted_at":"2023-05-25T17:59:49Z","title":"Ghost in the Minecraft: Generally Capable Agents for Open-World Environments via Large Language Models with Text-based Knowledge and Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17144","snapshot_observed_at":"2026-08-16T10:58:42.196567Z","title":"Ghost in the minecraft: Generally capable agents for open-world enviroments via large language models with text-based knowledge and memory","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.196567Z"},"links":{"cited_paper":"/paper/2305.17144","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:01a2d5d68e3d1639d1257b300e995cb14a1b00591737db7cfbf3079f0697971e","observation_id":"ca7dcac9-3f12-44e7-b429-56ceba489924","resolution":{"observed_at":"2026-08-16T10:58:42.196567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.245418Z","title":"Ludicorp","venue":null,"work_id":"14e05805-27fe-4586-bb09-bdf0831fb270","year":2025},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.273253Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:5272b9cb4aee163af4473a77b2de1eb5512f1d4b3fd0a5cb8eb66af29023c753","observation_id":"ac7a2f3f-01ec-4451-a99d-6083ca784488","resolution":{"observed_at":"2026-08-16T10:58:43.304821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:42.979709Z","title":"C.1 P ROMPTS FOR ACTION VALUE ESTIMATES You are a player in a text-based adventure game","venue":null,"work_id":"0fa7cec9-52d0-4391-bbda-18c71bf2e106","year":2025},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.280986Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:d525048cf002d1c5abf124b57fd1df6396985f826253e906a18d1e625cba08fb","observation_id":"15792876-41d6-465c-baaf-e3b4a7a34724","resolution":{"observed_at":"2026-08-16T10:58:43.116004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.229354Z","title":"The above configuration follows the work of Jang et al","venue":null,"work_id":"21c784b2-2d00-42cd-9683-c78fd8fab63e","year":2020},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.277005Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:799a4be352c1405c892441abf1d13f3489d8cfead4261374f93c633dc4efe7c3","observation_id":"09c0d79b-88ec-4341-9138-205214092f14","resolution":{"observed_at":"2026-08-16T10:58:43.234751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01534","last_updated":"2024-05-02T17:59:31Z","snapshot_observed_at":"2026-08-17T04:38:59.677031Z","submitted_at":"2024-05-02T17:59:31Z","title":"Plan-Seq-Learn: Language Model Guided RL for Solving Long Horizon Robotics Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01534","snapshot_observed_at":"2026-08-16T10:58:41.644515Z","title":"Plan-seq- learn: Language model guided rl for solving long horizon robotics tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.644515Z"},"links":{"cited_paper":"/paper/2405.01534","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:45fe70c43abeb2fdf2c52697dec4f6db1d0d8461e4045f24a2796ab1d72652fc","observation_id":"4415f38c-9c56-43b7-9703-46f5b45b8545","resolution":{"observed_at":"2026-08-16T10:58:41.644515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.720863Z","title":"A survey of monte carlo tree search methods","venue":null,"work_id":"bfa3dd29-b660-40a1-8aba-eb9ac96daf05","year":2025},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.534945Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:3cbc84f172ddb43799179f57f92d6d119c0d7b1d2a6e9820144a7b8dd12c7530","observation_id":"9e7829bd-555c-4b9e-a5b6-9ab89f30f83f","resolution":{"observed_at":"2026-08-16T10:58:43.740678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:58:43.561727Z","title":"A survey of text games for reinforcement learning informed by natural language","venue":null,"work_id":"59caaa40-ce28-4692-8133-e5d33c101f92","year":2025},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.869187Z"},"links":{"citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:77978e8fad0b73cb4980e35908ec52b8b8713dd430b334a4792d0412cdb50d22","observation_id":"965940d9-8d6a-446e-9725-e09f4bf8fa0d","resolution":{"observed_at":"2026-08-16T10:58:43.566875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16181","last_updated":"2024-02-25T20:07:13Z","snapshot_observed_at":"2026-08-16T14:15:30.607587Z","submitted_at":"2024-02-25T20:07:13Z","title":"How Can LLM Guide RL? A Value-Based Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16181","snapshot_observed_at":"2026-08-16T10:58:42.136576Z","title":"How can llm guide rl? a value-based approach","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:42.136576Z"},"links":{"cited_paper":"/paper/2402.16181","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:57eec0335807a29f18014b06737e00bdbb3ec0a94626bbaf0b4f529246927983","observation_id":"c4358c12-2b0b-4944-bde2-38d7a09c052c","resolution":{"observed_at":"2026-08-16T10:58:42.136576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08837","last_updated":"2020-01-23T22:33:18Z","snapshot_observed_at":"2026-08-09T15:00:51.941571Z","submitted_at":"2020-01-23T22:33:18Z","title":"Graph Constrained Reinforcement Learning for Natural Language Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08837","snapshot_observed_at":"2026-08-16T10:58:41.466534Z","title":"Graph constrained reinforcement learning for natural language action spaces","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.466534Z"},"links":{"cited_paper":"/paper/2001.08837","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:4b780c1a6b980e03ac5be29226f753b54a86f461a5cbb17908f750efb845f001","observation_id":"5b5f381c-a3bc-407a-8835-ede5b20b9c36","resolution":{"observed_at":"2026-08-16T10:58:41.466534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14334","last_updated":"2022-06-13T05:04:53Z","snapshot_observed_at":"2026-08-09T23:45:38.167954Z","submitted_at":"2022-05-28T05:02:31Z","title":"Teaching Models to Express Their Uncertainty in Words","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14334","snapshot_observed_at":"2026-08-16T10:58:41.813331Z","title":"Teaching models to express their uncertainty in words","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.813331Z"},"links":{"cited_paper":"/paper/2205.14334","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:d5a8debc80dc4738233c16c8a7130f2113802f89f3a00b5523543e8219d0b531","observation_id":"321daf36-88ca-4450-851f-bb42a8370e9c","resolution":{"observed_at":"2026-08-16T10:58:41.813331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19299","last_updated":"2024-02-29T16:07:22Z","snapshot_observed_at":"2026-08-16T14:14:05.006057Z","submitted_at":"2024-02-29T16:07:22Z","title":"RL-GPT: Integrating Reinforcement Learning and Code-as-policy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19299","snapshot_observed_at":"2026-08-16T10:58:41.817767Z","title":"Rl-gpt: Integrating reinforcement learning and code-as-policy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.817767Z"},"links":{"cited_paper":"/paper/2402.19299","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:842765c64d955c94b50bea980dd6b43583401ec2584660128f27c6ebe2a8c832","observation_id":"ee958864-4d1e-41be-853f-35a6b9e4f201","resolution":{"observed_at":"2026-08-16T10:58:41.817767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09334","last_updated":"2024-01-17T16:57:19Z","snapshot_observed_at":"2026-08-18T01:07:16.252743Z","submitted_at":"2024-01-17T16:57:19Z","title":"Large Language Models Are Neurosymbolic Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09334","snapshot_observed_at":"2026-08-16T10:58:41.800046Z","title":"Large language models are neurosymbolic reasoners","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.800046Z"},"links":{"cited_paper":"/paper/2401.09334","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:13f215e54ff14eab76a66b8844ed5e963de2514e4048da3625d14f9f8983ecc8","observation_id":"96ac6684-00c6-4070-9c37-3faa5a4917ac","resolution":{"observed_at":"2026-08-16T10:58:41.800046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.02757","last_updated":"2020-12-04T18:22:59Z","snapshot_observed_at":"2026-08-17T18:12:53.583981Z","submitted_at":"2020-12-04T18:22:59Z","title":"Playing Text-Based Games with Common Sense","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.02757","snapshot_observed_at":"2026-08-16T10:58:41.747857Z","title":"Playing text-based games with common sense","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T10:58:41.747857Z"},"links":{"cited_paper":"/paper/2012.02757","citing_paper":"/paper/2504.16855"},"observation_digest":"sha256:0277034652effdd67553940d1374ee6263ca8e60646afc98a5cecb4b68e97798","observation_id":"629d17d3-0239-487e-bc18-b33b1d761149","resolution":{"observed_at":"2026-08-16T10:58:41.747857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.16855","last_updated":"2025-04-23T16:23:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T18:40:02.408367Z","submitted_at":"2025-04-23T16:23:15Z","title":"Monte Carlo Planning with Large Language Model for Text-Based Game Agents"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":5,"verified_fuzzy":8},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 6 inbound Pith citation observations for arXiv:2504.16855."}