{"as_of":"2026-08-23T15:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ca3b233452afd0c05f7775597c804dd87be08e91c405084e9183e82588edc83c","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:43:44.588632Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T19:57:28.642081Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-14T19:57:53.008216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"cited_work":{"arxiv_id":"2411.15998","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.15998","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pianist: Learning partially observable world models with LLMs for multi-agent decision making","venue":null,"work_id":"84d3aff5-1b01-4d8b-9291-d89a0dbae9fb","year":2024},"citing_paper":{"arxiv_id":"2605.13740","last_updated":"2026-05-13T16:18:15Z","snapshot_observed_at":"2026-08-15T10:58:58.721424Z","submitted_at":"2026-05-13T16:18:15Z","title":"Learning POMDP World Models from Observations with Language-Model Priors","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T19:57:28.642081Z"},"links":{"cited_paper":"/paper/2411.15998","citing_paper":"/paper/2605.13740"},"observation_digest":"sha256:c7e3287e6428ddb7db519db65c9eef740edad7c12fa2eb0574eb913d8d261437","observation_id":"188fa228-d05f-43f1-a5f4-0a4cc1ff0956","resolution":{"observed_at":"2026-05-14T19:57:53.011851Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.15998/citation-record","integrity":"/paper/2411.15998/integrity","json":"/paper/2411.15998/citation-record.json","paper":"/paper/2411.15998"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-08-15T11:39:07.998070Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-12T13:43:43.538194Z","title":"Reasoning with language model is planning with world model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.538194Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:7d849ff096e24387f7602572f574e53b4366970c756a7ac607b8fe35ee50640f","observation_id":"5b0c882e-d921-430d-acd9-f47e4e404a7f","resolution":{"observed_at":"2026-08-12T13:43:43.538194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:43.586527Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.586527Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:2e2521def332d678d02046f482262b06a88fdf06c97923504bac613c7c8a02d5","observation_id":"ca4b6103-6783-427f-b524-e55acf297f8d","resolution":{"observed_at":"2026-08-12T13:43:43.586527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:45.107548Z","title":"Large language models as commonsense knowledge for large-scale task planning","venue":null,"work_id":"4f55bddc-93ac-46c3-8fc9-f14f9d34c6ab","year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.672346Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:2e1bf093468e024b83930bc007108425559d1e06c485b8db0d6a5cb602dcfebe","observation_id":"38222d46-6499-466d-86a7-580a2bee91ee","resolution":{"observed_at":"2026-08-12T13:43:45.112547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:45.091844Z","title":"Monte carlo sampling for regret minimization in extensive games","venue":null,"work_id":"e8a18fd5-e914-4095-827e-aa88d0f24e59","year":2009},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.753524Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:1099cbeab48f71ad28849ab0354718a66b198d9a5a0df96e3f2a2778a55ad405","observation_id":"ad0b0a45-03de-44ed-b7bc-04ec3f964834","resolution":{"observed_at":"2026-08-12T13:43:45.096714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:45.076252Z","title":"Goofspiel—the game of pure strategy","venue":null,"work_id":"2ef9b832-de67-40fd-aaf1-0dc9da87731d","year":1971},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.801317Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:766c4544bf3adfd0fff2b2a03d4f7cac0e3cbbf167bdb498f1c56636711b75ca","observation_id":"2f74efab-e0ac-4416-8729-31d176cd8665","resolution":{"observed_at":"2026-08-12T13:43:45.081083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:43.810390Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.810390Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:a1628e7fc3d38a65eac4b8100945ad876ce9ee783d5a52598149e886dd06e6d1","observation_id":"ea4ab028-eb46-4ad0-9fa6-33e784e8742c","resolution":{"observed_at":"2026-08-12T13:43:43.810390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:43.818224Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.818224Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:886bde24a1ba9552e30ba2ece9f97c68e8dcdfa09f4513776fa5e95110838206","observation_id":"ea0e2c91-cddc-48b7-9270-99fa402606f2","resolution":{"observed_at":"2026-08-12T13:43:43.818224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18940","last_updated":"2025-05-29T08:46:38Z","snapshot_observed_at":"2026-08-21T00:47:36.025489Z","submitted_at":"2023-10-29T09:02:57Z","title":"Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18940","snapshot_observed_at":"2026-08-12T13:43:43.822759Z","title":"Language agents with reinforcement learning for strategic play in the werewolf game","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.822759Z"},"links":{"cited_paper":"/paper/2310.18940","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:1d17fb556ac6bf5bde7b3b9a053aa8aea0a7287098589466f4a80d2aa6fd23f5","observation_id":"ce9a996d-2914-42f5-8a99-a4e07993ed8b","resolution":{"observed_at":"2026-08-12T13:43:43.822759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-12T13:43:43.874871Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.874871Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:9ff753247aaa49ff0c2ba83f41b2ab90645e3fde9ec4bb7b43dd2c61f846950a","observation_id":"a6f93e22-c972-440d-9ba0-b103cb32df81","resolution":{"observed_at":"2026-08-12T13:43:43.874871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:45.042754Z","title":null,"venue":null,"work_id":"e2ba0499-d083-49cd-8250-0278f9783d78","year":2020},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:43.972719Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:0f01adfe060bdbe925808a4cf3c1f727b08f5a6ff619e2f7d87054daa7fc4f96","observation_id":"01c4e971-62ba-46f1-be72-9a1249272b6d","resolution":{"observed_at":"2026-08-12T13:43:45.046986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.016023Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.016023Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:8748dd9efc26ad168f158d4cd2305ab5d09e69a5584b469bc80737ea461c1495","observation_id":"78e3d0fc-a454-4fc2-8684-34fe8764da5b","resolution":{"observed_at":"2026-08-12T13:43:44.016023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-17T00:14:01.413100Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-12T13:43:44.021976Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.021976Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:215cf7f9c35f3990b50b394b648d58a0514fe4b537c7eeaf81b30905f7ce034c","observation_id":"43a2232d-0cd7-4c6d-8384-836b36067e2a","resolution":{"observed_at":"2026-08-12T13:43:44.021976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-12T13:43:44.069372Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.069372Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:b8a59bdadf25e61f080c37a668fc2b1c3bad66fabf463a42614540db02e50b9f","observation_id":"b47e2153-3a4f-4897-aa80-5d321b527486","resolution":{"observed_at":"2026-08-12T13:43:44.069372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-08-18T19:51:48.688199Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-12T13:43:44.118159Z","title":"Chi, Jeff Dean, Jacob Devlin, Adam Roberts, Denny Zhou, Quoc V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.118159Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:1dfa081cf1c04f1a8c95b33826c9ca34481d17e1b5a55c6e688d5ef7367b9920","observation_id":"fb1ce79f-e34d-48be-aace-4a0cba00ccd9","resolution":{"observed_at":"2026-08-12T13:43:44.118159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09296","last_updated":"2024-07-01T03:38:57Z","snapshot_observed_at":"2026-08-16T15:23:34.684133Z","submitted_at":"2023-06-15T17:20:46Z","title":"KoLA: Carefully Benchmarking World Knowledge of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09296","snapshot_observed_at":"2026-08-12T13:43:44.146259Z","title":"Kola: Carefully benchmarking world knowledge of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.146259Z"},"links":{"cited_paper":"/paper/2306.09296","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:57a248451ade284c5640a3a8ec96e92386ec8f4e53ace587b30fc2f589896683","observation_id":"e9890aa8-e90f-4f8e-8081-f97447c54b5c","resolution":{"observed_at":"2026-08-12T13:43:44.146259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:45.018023Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":"24b61ec0-411b-47e3-8f1f-dd50ed217c41","year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.150748Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:2dafc074b9372df9e1644d01a6a6d2c6098062225776df960cf52401c08e9ed5","observation_id":"afb0d613-9220-438f-af83-d41e1f937224","resolution":{"observed_at":"2026-08-12T13:43:45.022698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-12T13:43:44.155461Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.155461Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:4845e973db979e36ff062ec7c19282ae5ed09cb051b2236cd0569f0c52044db0","observation_id":"162821ce-f19b-4af0-9db0-a84c690985db","resolution":{"observed_at":"2026-08-12T13:43:44.155461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-08-13T16:55:46.498156Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-12T13:43:44.160285Z","title":"V oyager: An open-ended embodied agent with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.160285Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:2f4af4b1e63c64721c3b95fc92764988a9c89831e95f1f6f2996dcc92a975c4b","observation_id":"84ede876-d799-421b-8bb9-71c4d51a97b0","resolution":{"observed_at":"2026-08-12T13:43:44.160285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05608","last_updated":"2022-07-12T15:20:48Z","snapshot_observed_at":"2026-08-17T09:42:08.942018Z","submitted_at":"2022-07-12T15:20:48Z","title":"Inner Monologue: Embodied Reasoning through Planning with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05608","snapshot_observed_at":"2026-08-12T13:43:44.254195Z","title":"Inner monologue: Embodied reasoning through planning with language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.254195Z"},"links":{"cited_paper":"/paper/2207.05608","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:de1423be88bcfde25fbeda1d04eae756a4786cc66f81eb541b7d9bc5cd7adc32","observation_id":"368e6985-d7e8-4b53-8466-68fdab63c874","resolution":{"observed_at":"2026-08-12T13:43:44.254195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-08-16T03:49:04.888755Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-12T13:43:44.365453Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.365453Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:07ee768143c8a9a57a68793606ae2e7ef471dc95a25292872fbb336aa7434c5f","observation_id":"eb491abc-5bbe-405d-9dad-d4d71e8a17c3","resolution":{"observed_at":"2026-08-12T13:43:44.365453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.378143Z","title":"Toolformer: Language models can teach themselves to use tools","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.378143Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:920103e457e385a758140993184581b05d68eb50761617fcb25a175b59951f49","observation_id":"f2b9ff32-3dd6-46dd-abb0-92ca366799cc","resolution":{"observed_at":"2026-08-12T13:43:44.378143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17126","last_updated":"2024-03-11T01:15:09Z","snapshot_observed_at":"2026-08-16T15:29:12.827405Z","submitted_at":"2023-05-26T17:50:11Z","title":"Large Language Models as Tool Makers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17126","snapshot_observed_at":"2026-08-12T13:43:44.383545Z","title":"Large language models as tool makers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.383545Z"},"links":{"cited_paper":"/paper/2305.17126","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:df8e9208b915c5941b207b2dfa204801b50748dedab4460d12e6f55d6b7d1c70","observation_id":"57b23c19-bc45-4597-a160-b4ef21cda2ac","resolution":{"observed_at":"2026-08-12T13:43:44.383545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T13:43:44.388112Z","title":"Chain of thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.388112Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:dc1c5ca240e5d57ddfcc0974ba0a155b94473a4179f9e5f185b7870827c465b2","observation_id":"20edc0cf-3a9a-48c5-a596-1b0cf28bed22","resolution":{"observed_at":"2026-08-12T13:43:44.388112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.392750Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.392750Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:f0a987ca77af3f7c46d90ab7cf8c168d12f1f23aa1bfd747a48d7b776550260d","observation_id":"de67268e-3c7c-4f17-bc42-8908d63fda50","resolution":{"observed_at":"2026-08-12T13:43:44.392750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05230","last_updated":"2023-12-08T18:25:22Z","snapshot_observed_at":"2026-08-16T14:36:26.492028Z","submitted_at":"2023-12-08T18:25:22Z","title":"Language Models, Agent Models, and World Models: The LAW for Machine Reasoning and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05230","snapshot_observed_at":"2026-08-12T13:43:44.397366Z","title":"Language models, agent models, and world models: The law for machine reasoning and planning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.397366Z"},"links":{"cited_paper":"/paper/2312.05230","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:1c21975dd39dad6cf5a626fa4830f00658499a8cd74d7ee7a40cebf2cceeed9f","observation_id":"b33480d0-05a8-4eed-b71b-ca1648b4c7e7","resolution":{"observed_at":"2026-08-12T13:43:44.397366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.428090Z","title":"Leveraging pre-trained large language models to construct and utilize world models for model-based task planning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.428090Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:5ebf43f513c3fd4ef4e59557fe6b3160ac91fa09d629ec146ebfac8f291eb63e","observation_id":"0e3f1647-f637-4be7-b120-16ab252df1f4","resolution":{"observed_at":"2026-08-12T13:43:44.428090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-08-18T16:01:12.797308Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-12T13:43:44.467524Z","title":"Alphazero-like tree-search can guide large language model decoding and training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.467524Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:75c358bf8f3ab740a9fc61059f1689f468990d59d9731f45d925951db2490b28","observation_id":"7645cd5e-ad11-44b8-8dc5-db8d4b2aa4a2","resolution":{"observed_at":"2026-08-12T13:43:44.467524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10134","last_updated":"2023-10-16T07:17:27Z","snapshot_observed_at":"2026-08-19T13:27:14.048616Z","submitted_at":"2023-10-16T07:17:27Z","title":"CLIN: A Continually Learning Language Agent for Rapid Task Adaptation and Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10134","snapshot_observed_at":"2026-08-12T13:43:44.542891Z","title":"Clin: A continually learning language agent for rapid task adaptation and generalization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.542891Z"},"links":{"cited_paper":"/paper/2310.10134","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:bee303560dfcced672806a6a9bdbd35471ddda251d93eb09f1de96684e4e82cb","observation_id":"2b8a6671-11a5-4d16-bbcb-9d3b965cbbe1","resolution":{"observed_at":"2026-08-12T13:43:44.542891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.550585Z","title":"Expel: Llm agents are experiential learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.550585Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:a3d22d37e55b28ebff198fbeb30adbabcf21dcc860ce4cea2eeda085d8caac1a","observation_id":"be6b53de-7adb-4479-b91d-c08d0b8207f3","resolution":{"observed_at":"2026-08-12T13:43:44.550585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12931","last_updated":"2024-04-30T21:35:53Z","snapshot_observed_at":"2026-08-02T10:40:03.816188Z","submitted_at":"2023-10-19T17:31:01Z","title":"Eureka: Human-Level Reward Design via Coding Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12931","snapshot_observed_at":"2026-08-12T13:43:44.555592Z","title":"Eureka: Human-level reward design via coding large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.555592Z"},"links":{"cited_paper":"/paper/2310.12931","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:1d9e982e13daa701a1b42736bb0c2116bfb7b96156f7e0f286c38ed58eb66b0c","observation_id":"46d712ec-dd39-4cf2-aed6-eb17f9577512","resolution":{"observed_at":"2026-08-12T13:43:44.555592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08647","last_updated":"2023-06-16T23:02:21Z","snapshot_observed_at":"2026-08-17T22:16:17.971851Z","submitted_at":"2023-06-14T17:27:10Z","title":"Language to Rewards for Robotic Skill Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08647","snapshot_observed_at":"2026-08-12T13:43:44.561260Z","title":"Language to rewards for robotic skill synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.561260Z"},"links":{"cited_paper":"/paper/2306.08647","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:275204d9aea9fdd2fa92d61cd3e3969173b4e611f1ab26e90ff8144370b78e45","observation_id":"cc6d9f2d-48de-4635-a607-70d547252ef2","resolution":{"observed_at":"2026-08-12T13:43:44.561260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.566422Z","title":"Mastering the game of go without human knowledge","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.566422Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:78d05eec2aa0cafaf422abd534835b1d845b0896d90d74b3af1fcf89bf6d964e","observation_id":"b09fb152-41f9-4892-a2f3-7b47440a957c","resolution":{"observed_at":"2026-08-12T13:43:44.566422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.571043Z","title":"Mastering atari, go, chess and shogi by planning with a learned model","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.571043Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:b1b29005dda42890061052e45ccfe3ab718349af277a1df572bc613cecf15ab6","observation_id":"6699ac5c-fd7d-463a-9757-63e33dd6e6a6","resolution":{"observed_at":"2026-08-12T13:43:44.571043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.576045Z","title":"Human-level play in the game of diplomacy by combining language models with strategic reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.576045Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:294954aabed813946503154c1d6d6c12f224349eb7ee6a039367bde54420fec1","observation_id":"af434a38-ff5b-4dd3-af24-c6b4c789e5fe","resolution":{"observed_at":"2026-08-12T13:43:44.576045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17234","last_updated":"2024-06-10T14:43:34Z","snapshot_observed_at":"2026-08-16T14:56:31.164308Z","submitted_at":"2023-09-29T13:33:06Z","title":"Cooperation, Competition, and Maliciousness: LLM-Stakeholders Interactive Negotiation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17234","snapshot_observed_at":"2026-08-12T13:43:44.580193Z","title":"Llm- deliberation: Evaluating llms with interactive multi-agent negotiation games","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.580193Z"},"links":{"cited_paper":"/paper/2309.17234","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:81686cc1dd2e7d0b2c35d32460163a34fb9bae2e3544b9544636a3ac248e8e43","observation_id":"7106c292-d144-4a14-84be-dd224f8c855f","resolution":{"observed_at":"2026-08-12T13:43:44.580193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10142","last_updated":"2023-05-17T11:55:32Z","snapshot_observed_at":"2026-08-18T17:01:24.684622Z","submitted_at":"2023-05-17T11:55:32Z","title":"Improving Language Model Negotiation with Self-Play and In-Context Learning from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10142","snapshot_observed_at":"2026-08-12T13:43:44.584395Z","title":"Improving language model negotiation with self-play and in-context learning from ai feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.584395Z"},"links":{"cited_paper":"/paper/2305.10142","citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:c8afa355ed3847ecf990bc9e75782abb2ab4ddcbaf75d23716c6e5f1967bdd32","observation_id":"f45de332-411c-4393-87f4-47494ee8d054","resolution":{"observed_at":"2026-08-12T13:43:44.584395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:43:44.932468Z","title":"State␣must␣be␣an␣instance␣of␣HiddenState","venue":null,"work_id":"78da81fc-9dab-4cb1-8dc9-2bbb25866ead","year":2019},"citing_paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:43:44.588632Z"},"links":{"citing_paper":"/paper/2411.15998"},"observation_digest":"sha256:cba727c48b349f28fa43fe3946f5fe405cfccfa7f41125e5c45b59ab6b2a4869","observation_id":"fc35932e-76fd-4586-a27f-16f4c07c1be2","resolution":{"observed_at":"2026-08-12T13:43:44.938409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.15998","last_updated":"2024-11-24T22:36:34Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T21:16:39.582153Z","submitted_at":"2024-11-24T22:36:34Z","title":"PIANIST: Learning Partially Observable World Models with LLMs for Multi-Agent Decision Making"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2411.15998."}