{"as_of":"2026-08-09T13:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22c6d8500ea3f7a75dc64a9ac0f14520218252c268f14264f911e8520a69e014","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T21:45:45.538720Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:21.027074Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T23:42:49.549067Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04728","snapshot_observed_at":"2026-08-06T19:14:21.027074Z","title":"Generating symbolic world models via test-time scaling of large language models.arXiv preprint arXiv:2502.04728, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06181","last_updated":"2025-07-08T17:03:39Z","snapshot_observed_at":"2026-08-07T16:09:15.554628Z","submitted_at":"2025-07-08T17:03:39Z","title":"CriticLean: Critic-Guided Reinforcement Learning for Mathematical Formalization","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:21.027074Z"},"links":{"cited_paper":"/paper/2502.04728","citing_paper":"/paper/2507.06181"},"observation_digest":"sha256:838806b96ca55a6d6c7bd34943b86e9abc8a9f2e329868addd3f48cd965e5fe8","observation_id":"d1d36373-ba35-402f-b684-c848f9aea5ad","resolution":{"observed_at":"2026-08-06T19:14:21.027074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04728","snapshot_observed_at":"2026-08-04T06:05:30.314068Z","title":"Generating symbolic world models via test- time scaling of large language models.arXiv preprint arXiv:2502.04728, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.12244","last_updated":"2026-07-31T18:48:16Z","snapshot_observed_at":"2026-08-06T23:10:58.591524Z","submitted_at":"2026-02-12T18:28:28Z","title":"Any House Any Task: Scalable Long-Horizon Planning for Abstract Human Tasks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T06:05:30.314068Z"},"links":{"cited_paper":"/paper/2502.04728","citing_paper":"/paper/2602.12244"},"observation_digest":"sha256:2aa0925ab6ddd3963cf542ef91d0d2fadac0145e9a36340c3e08a494822b8735","observation_id":"fdba0c82-df4a-4742-a488-ce638e579571","resolution":{"observed_at":"2026-08-04T06:05:30.314068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"cited_work":{"arxiv_id":"2502.04728","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04728","snapshot_observed_at":"2026-06-28T23:42:49.549067Z","title":"arXiv preprint arXiv:2502.04728 , year=","venue":null,"work_id":"f9243485-aa6f-4d08-b362-060e2e75f449","year":null},"citing_paper":{"arxiv_id":"2606.07602","last_updated":"2026-05-29T09:31:25Z","snapshot_observed_at":"2026-07-06T23:47:15.041928Z","submitted_at":"2026-05-29T09:31:25Z","title":"Sample-Efficient Post-Training for LEGO Spatial-Physics Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-28T23:38:38.127345Z"},"links":{"cited_paper":"/paper/2502.04728","citing_paper":"/paper/2606.07602"},"observation_digest":"sha256:19ea37a1fbbe025a48cf3ecf60a021688ede5e2c1dfc9b9012115287e16205b7","observation_id":"b55257f8-e899-462e-a68e-8fb55168961d","resolution":{"observed_at":"2026-06-28T23:42:49.550411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04728/citation-record","integrity":"/paper/2502.04728/integrity","json":"/paper/2502.04728/citation-record.json","paper":"/paper/2502.04728"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T21:45:45.239493Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.239493Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:679b9ab0970491d05aff6363a3d6f42d6c60f7b5714b161a74601d3ea7047288","observation_id":"03cd33d5-726d-41df-939a-57dd9a284dfe","resolution":{"observed_at":"2026-08-08T21:45:45.239493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.840998Z","title":"Learning discrete world models for heuristic search","venue":null,"work_id":"957a63dc-4875-4744-9862-29fd8e580ed7","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.245571Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:21370aaa46262cf48cf47e5aa5134952e9472e0bba331142b1f8c13bb00b2e69","observation_id":"0333c392-25f1-4a9e-baa1-91417723d13c","resolution":{"observed_at":"2026-08-08T21:45:46.845605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-08T21:45:45.250220Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.250220Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:3ce46500cc4439cbc4e0de6dbf2db864e80d66f315470f1a4e2133309222f169","observation_id":"36c5cbae-ff49-461e-acf8-180ea3d9df5d","resolution":{"observed_at":"2026-08-08T21:45:45.250220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.826834Z","title":"Learning warm-start points for ac optimal power flow","venue":null,"work_id":"dc864cee-205e-402c-8c3e-2e98c17e7656","year":2019},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.255223Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:c4a256970d780ceceb7e8f0015bb4b4cc3da27bb6e24428c8197beead37e1fd6","observation_id":"6d31b2ee-9447-45c1-8cab-ecccf8d49965","resolution":{"observed_at":"2026-08-08T21:45:46.831395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15657","last_updated":"2025-02-24T18:14:15Z","snapshot_observed_at":"2026-08-08T14:17:37.842596Z","submitted_at":"2025-02-21T18:28:36Z","title":"Superintelligent Agents Pose Catastrophic Risks: Can Scientist AI Offer a Safer Path?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15657","snapshot_observed_at":"2026-08-08T21:45:45.260053Z","title":"Superintelligent agents pose catastrophic risks: Can scientist ai offer a safer path?arXiv preprint arXiv:2502.15657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.260053Z"},"links":{"cited_paper":"/paper/2502.15657","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:232dd9f8245029efa0ee24a7563e34cba85b383edf50b25c32883aef26828b07","observation_id":"9e4b8858-2e3f-44c4-bf71-3ca19a79f864","resolution":{"observed_at":"2026-08-08T21:45:45.260053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-08T21:45:45.265018Z","title":"Openai gym.arXiv preprint arXiv:1606.01540, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.265018Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:5f57b77103b4a66b32daec20cff7b510fe5e49cafc72a9bc78b8c688655b41fe","observation_id":"39f13cc1-2b1d-46b8-a381-21be6515f46a","resolution":{"observed_at":"2026-08-08T21:45:45.265018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.811792Z","title":"Language models are few-shot learners","venue":null,"work_id":"56213112-62cf-4578-b652-3c3f93f81a1c","year":2020},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.270167Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:1f096c3a36ad864ff4c369e37152024f03dee967c82355756e8153784cf672f6","observation_id":"85844672-b9dc-4afe-982a-cc1b173a2e71","resolution":{"observed_at":"2026-08-08T21:45:46.816778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T21:45:45.275330Z","title":"Evaluating large language models trained on code.arXiv preprint arXiv:2107.03374, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.275330Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:fccddf7818614a1cf2fc836f2e4eb27ef363b954f70e43c3aa9e42ccbe1615b8","observation_id":"bcbf0079-ae87-45ce-989a-c8b37f8c7cad","resolution":{"observed_at":"2026-08-08T21:45:45.275330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-08T21:45:45.280344Z","title":"Program of thoughts prompting: Dis- entangling computation from reasoning for numerical reasoning tasks.arXiv preprint arXiv:2211.12588,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.280344Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:c8e2a685e1b2c3810a7824608099a65fb702024fb2a6f63a5ffed5ea3a825d25","observation_id":"ede1b7a6-2aa2-4a1f-8c27-e9012feacaf2","resolution":{"observed_at":"2026-08-08T21:45:45.280344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00114","last_updated":"2024-08-07T00:52:07Z","snapshot_observed_at":"2026-07-06T18:55:15.704075Z","submitted_at":"2024-07-31T18:47:11Z","title":"Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00114","snapshot_observed_at":"2026-08-08T21:45:45.285649Z","title":"Inductive or deductive? rethinking the fundamental reasoning abilities of llms.arXiv preprint arXiv:2408.00114, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.285649Z"},"links":{"cited_paper":"/paper/2408.00114","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:14e0261482354b1c28c83320c6db49e054b513d11b0dcae4383a7bb234036e22","observation_id":"f07b44fe-b95c-485b-ad97-09d742351135","resolution":{"observed_at":"2026-08-08T21:45:45.285649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-08T21:45:45.290407Z","title":"Train- ing verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.290407Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:8a96c86b8f5242daaffc12b01295ece3b311cb8594f9965b96e8b502a5974a97","observation_id":"0ea578a5-37f1-4a1d-a3e8-dc8c91c33b24","resolution":{"observed_at":"2026-08-08T21:45:45.290407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15383","last_updated":"2024-10-30T14:19:57Z","snapshot_observed_at":"2026-08-04T20:30:04.010619Z","submitted_at":"2024-05-24T09:31:26Z","title":"Generating Code World Models with Large Language Models Guided by Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15383","snapshot_observed_at":"2026-08-08T21:45:45.295334Z","title":"Generating code world models with large language models guided by monte carlo tree search.arXiv preprint arXiv:2405.15383, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.295334Z"},"links":{"cited_paper":"/paper/2405.15383","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:176d9b9e9044920a9509b929896cd13f3b685aa102ff3004b4fce04df136d0d8","observation_id":"e46c3c3c-c61a-4dc6-93bf-14d15caae9ad","resolution":{"observed_at":"2026-08-08T21:45:45.295334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.797455Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models","venue":null,"work_id":"e52f74ff-06a0-4ae5-a3aa-ad1c0c9f578d","year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.299976Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:43201de0d6510027b2a3ef27fb8d1c28a400838c8868387fde34d28a06a3053e","observation_id":"9cae3b3f-2bc0-4940-a254-af6b3f0c1477","resolution":{"observed_at":"2026-08-08T21:45:46.802075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-08T21:45:45.304298Z","title":"A survey on in-context learning.arXiv preprint arXiv:2301.00234, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.304298Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:4abce5131cbb0eefbba29e2c66ee0826589a76da0588dd6d78fe8c17cc1f4502","observation_id":"bba694be-40d2-4597-b281-d6988b038b87","resolution":{"observed_at":"2026-08-08T21:45:45.304298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T21:45:45.309015Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.309015Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:8d91bd98eb91a2abc712cd6934968522e8b6865fe3720825906c2f0252cc5760","observation_id":"eefa8b78-3ad8-45ac-92c2-2fa09093e5a1","resolution":{"observed_at":"2026-08-08T21:45:45.309015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.783190Z","title":"Fikes and Nils J","venue":null,"work_id":"c9e54541-b5b7-42a8-ad98-757ea274aca6","year":1971},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.313744Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:d475ea3b6eea34b5d0d2b7b8c86802a1f6f2dabc3fcc4e7b6989917a72da0ce1","observation_id":"05e9d0c6-f8f0-4c7b-b83d-8b830a7848a5","resolution":{"observed_at":"2026-08-08T21:45:46.787696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.768215Z","title":"Leveraging pre- trained large language models to construct and utilize world models for model-based task planning","venue":null,"work_id":"a0c77c37-156b-4792-a5b5-3c2ca5a3497b","year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.318349Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:25e68e7a4886a4f9fd558b5e6a870fd3a6e3753af5c76f5164a87e5af6a2b138","observation_id":"a8196531-c14f-4dd2-9fa5-80c78856f6b5","resolution":{"observed_at":"2026-08-08T21:45:46.773058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14992","last_updated":"2023-10-23T07:24:28Z","snapshot_observed_at":"2026-07-06T15:32:25.931739Z","submitted_at":"2023-05-24T10:28:28Z","title":"Reasoning with Language Model is Planning with World Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14992","snapshot_observed_at":"2026-08-08T21:45:45.322784Z","title":"Reasoning with language model is planning with world model.arXiv preprint arXiv:2305.14992, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.322784Z"},"links":{"cited_paper":"/paper/2305.14992","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:213987cc3d13fe98af3a6582dbca4e259e3ef8f939fc8c24bf82f6d4d69ab571","observation_id":"b7d8ce2b-c5dc-43e9-bd3b-a8549d7d7275","resolution":{"observed_at":"2026-08-08T21:45:45.322784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.754085Z","title":"The fast downward planning system","venue":null,"work_id":"eea81d38-f81f-4662-8fff-f3b7f332c3f1","year":2006},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.327277Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:b9422bf78ba51150396793d69fe52e2a50acb5320f780101685d368fd91644c2","observation_id":"7f0a7224-bc1f-4018-8a5d-da4c5e801049","resolution":{"observed_at":"2026-08-08T21:45:46.758668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.738893Z","title":"The Competition: Impact, Organization, Evaluation, Benchmarks","venue":null,"work_id":"8696187f-9e39-4636-afbb-3f0532a73601","year":2003},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.331678Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:2f13e1aac642647118c0fcbf2862b2031ed344649d42e20fe4d7295ef54aea26","observation_id":"ae4c5c4b-61de-4c3b-8da5-288a88e88961","resolution":{"observed_at":"2026-08-08T21:45:46.744061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.724601Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"d2544925-16c6-47b0-8df2-3100223c9d46","year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.335951Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:d439aac218dd6c9392ce6e1a2ee2db939fce5568abfe5052475301d9e32e8c55","observation_id":"8f457a45-904f-4767-b2c9-6c79ece777c4","resolution":{"observed_at":"2026-08-08T21:45:46.729161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-08T21:45:45.340311Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.340311Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:2580b4bad3dbff2bfc1d212bb0c3f88c90504bd89ddf452ef74498ce742f2d48","observation_id":"6a196f09-0952-4697-b545-3cb315e96399","resolution":{"observed_at":"2026-08-08T21:45:45.340311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-08T21:45:45.345137Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.345137Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:18f1b9a0b4e328618b99cf54b17388d39656518c71f24918196413cfa11e35cf","observation_id":"646869af-157b-450d-b043-6057ffe4fe10","resolution":{"observed_at":"2026-08-08T21:45:45.345137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.709880Z","title":"Can large language models reason and plan?Annals of the New York Academy of Sciences, 1534(1):15–18, 2024","venue":null,"work_id":"c79e0bd9-0dad-4d3b-bcbc-920e4d26c1a2","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.350020Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:862c5bb1aabb00ab5705dedb594715bb857902e574946a838ed4e001d905b10b","observation_id":"1a73d1ce-9422-42c9-910b-472c4d627b15","resolution":{"observed_at":"2026-08-08T21:45:46.714844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.694952Z","title":"Parameter-efficient orthogonal finetuning via butterfly factorization","venue":null,"work_id":"fe88a0fc-ca37-48a5-aec1-d615ebec02e8","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.354281Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:84c77848215b07651473fdfc069484c1a838834bbb41f9506d3d54517e111576","observation_id":"f93ed7bc-4342-4b77-8817-7936a8abda61","resolution":{"observed_at":"2026-08-08T21:45:46.699971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12979","last_updated":"2024-11-09T05:23:47Z","snapshot_observed_at":"2026-07-06T18:48:08.251086Z","submitted_at":"2024-07-17T19:50:51Z","title":"Leveraging Environment Interaction for Automated PDDL Translation and Planning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12979","snapshot_observed_at":"2026-08-08T21:45:45.359163Z","title":"Leveraging environment interaction for automated pddl translation and planning with large language models.arXiv preprint arXiv:2407.12979,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.359163Z"},"links":{"cited_paper":"/paper/2407.12979","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:00cc663f4a1425ad3bf6f016c2ba3e7e8767f0c8adc6cbdabc97942387c1d3b4","observation_id":"946a65a8-9d97-4a61-a89a-5c4701501fea","resolution":{"observed_at":"2026-08-08T21:45:45.359163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.680691Z","title":"Howe, Craig A","venue":null,"work_id":"42565613-f368-4b58-b835-ab429c08b942","year":1998},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.363988Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:2d7987d95645d6acb684cfae1f1dec420d381d340e6b1d8d7dd28cc73dadf61a","observation_id":"54cfd0fa-f274-448c-b515-e2a85c50e5a1","resolution":{"observed_at":"2026-08-08T21:45:46.685254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-08T21:45:45.368651Z","title":"Gsm-symbolic: Understanding the limitations of mathematical reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.368651Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:ba9a37b9248a129f36c95fc73be1d6ed4b1de6ebff1c0023859fb86094603e23","observation_id":"45ab39e7-1ebf-4626-884c-998a24d671d0","resolution":{"observed_at":"2026-08-08T21:45:45.368651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:45.374118Z","title":"Fully autonomous ai agents should not be developed.arXiv preprint arXiv:2502.02649, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.374118Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:e5ba8a3affed0a9c8a91de179f0b1786bf9741562ce152a9aa8b8e2f937af2fd","observation_id":"b772d60b-b75b-43d3-831e-f8a9906aac37","resolution":{"observed_at":"2026-08-08T21:45:45.374118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.666474Z","title":"Large language models as planning domain generators","venue":null,"work_id":"e340962e-f8e9-4d46-9a70-d696901bd01f","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.378530Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:3abf2da804e458ff5a653d68a8d09a7d54b82658334f5d9a6d8b9e824217719e","observation_id":"68346e29-ac90-4df6-99d3-75a7b5ab64fc","resolution":{"observed_at":"2026-08-08T21:45:46.671010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03495","last_updated":"2023-10-19T04:37:25Z","snapshot_observed_at":"2026-08-06T03:31:54.947656Z","submitted_at":"2023-05-04T15:15:22Z","title":"Automatic Prompt Optimization with \"Gradient Descent\" and Beam Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03495","snapshot_observed_at":"2026-08-08T21:45:45.383025Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.383025Z"},"links":{"cited_paper":"/paper/2305.03495","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:b46ba48b5859d910e4d94512a15c132b00df2fa31f06882222be79c9d880b6b6","observation_id":"ed5725ed-d274-40e8-89c1-761ee62b7939","resolution":{"observed_at":"2026-08-08T21:45:45.383025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18982","last_updated":"2024-10-08T15:13:01Z","snapshot_observed_at":"2026-07-06T19:39:15.025945Z","submitted_at":"2024-10-08T15:13:01Z","title":"O1 Replication Journey: A Strategic Progress Report -- Part 1","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18982","snapshot_observed_at":"2026-08-08T21:45:45.387659Z","title":"O1 replication journey: A strategic progress report–part 1","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.387659Z"},"links":{"cited_paper":"/paper/2410.18982","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:7ca36c807780f13801a0e441bcf846230663a4b1af492f89fbf0ea00a89e1f5a","observation_id":"654adc1e-7ed5-4d85-901d-6daa106d887e","resolution":{"observed_at":"2026-08-08T21:45:45.387659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.651619Z","title":"Controlling text-to-image diffusion by orthogonal finetuning","venue":null,"work_id":"0395ec1c-7750-4ed3-9c17-06b445469669","year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.391868Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:236c45b67c4b99e95c1de059f020f3cb41ade5da98a711cb4c58178e3570c07b","observation_id":"d184fcdf-b6bd-47af-9930-beae695c542e","resolution":{"observed_at":"2026-08-08T21:45:46.656622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.632922Z","title":"Pearson, 2016","venue":null,"work_id":"c3cf66e8-93ab-412d-a68d-553cb3771ab3","year":2016},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.396629Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:f924b08bd90e49da8b4bc7f8cb5c1904a3bfe2d0e16a13343e577cd7d621cf3e","observation_id":"0713ec78-5d08-4f1c-bdff-b5e5fc75dd4e","resolution":{"observed_at":"2026-08-08T21:45:46.637822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02158","last_updated":"2025-02-03T08:21:47Z","snapshot_observed_at":"2026-08-08T18:20:28.918685Z","submitted_at":"2024-11-04T15:17:19Z","title":"Learning Multiple Initial Solutions to Optimization Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02158","snapshot_observed_at":"2026-08-08T21:45:45.401048Z","title":"Learning multiple initial solutions to optimization problems.arXiv preprint arXiv:2411.02158, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.401048Z"},"links":{"cited_paper":"/paper/2411.02158","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:da9b6c3e3a0259e20abf3a334f986caf2d2ccaf9fd75a84007b0e3100ac64821","observation_id":"9fadc9f0-a05a-4a15-8305-74c25f31662e","resolution":{"observed_at":"2026-08-08T21:45:45.401048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.617113Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in Neural Information Processing Sys- tems, 36:8634–8652, 2023","venue":null,"work_id":"b150d7d6-4a5c-4fb3-944b-d84c7d2f7f75","year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.405565Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:9ed4efad8504f664e4e41ae522bc4d8ea5dd99dd2c3bada100a2c7279db3d174","observation_id":"57bc6fa8-88cf-4830-a177-cab53de0f5b8","resolution":{"observed_at":"2026-08-08T21:45:46.622404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03768","last_updated":"2021-03-14T22:44:38Z","snapshot_observed_at":"2026-08-08T17:40:47.037804Z","submitted_at":"2020-10-08T05:13:36Z","title":"ALFWorld: Aligning Text and Embodied Environments for Interactive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03768","snapshot_observed_at":"2026-08-08T21:45:45.409955Z","title":"Alfworld: Aligning text and embodied environments for interactive learning.arXiv preprint arXiv:2010.03768, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.409955Z"},"links":{"cited_paper":"/paper/2010.03768","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:493d8afce1489ef85a65ca719ccd82143ac342aedb08f107f7435503fa5c8f30","observation_id":"7a02912c-cd62-4dad-b69b-5270c4090adf","resolution":{"observed_at":"2026-08-08T21:45:45.409955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07751","last_updated":"2024-04-11T13:48:48Z","snapshot_observed_at":"2026-08-09T12:31:56.225750Z","submitted_at":"2024-04-11T13:48:48Z","title":"Generating consistent PDDL domains with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07751","snapshot_observed_at":"2026-08-08T21:45:45.414679Z","title":"Generating consistent pddl domains with large language models.arXiv preprint arXiv:2404.07751, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.414679Z"},"links":{"cited_paper":"/paper/2404.07751","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:3ebe1696f238272846b2d8ab5889f8b4381eadefd8a5ea70d013db4d432414d9","observation_id":"aa6afb8f-1814-45f2-a363-8dae05abc82a","resolution":{"observed_at":"2026-08-08T21:45:45.414679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:45.419311Z","title":"Inference scaling flaws: The limits of llm resampling with imperfect verifiers.arXiv preprint arXiv:2411.17501, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.419311Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:702289e833c4a5b44f87309e8d0a1931e93342167f1b7fe0b7042d6689a80e38","observation_id":"8b811352-2a25-4087-9114-a9c5b07014ac","resolution":{"observed_at":"2026-08-08T21:45:45.419311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12275","last_updated":"2024-09-20T18:56:41Z","snapshot_observed_at":"2026-08-08T15:50:41.166007Z","submitted_at":"2024-02-19T16:39:18Z","title":"WorldCoder, a Model-Based LLM Agent: Building World Models by Writing Code and Interacting with the Environment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12275","snapshot_observed_at":"2026-08-08T21:45:45.423844Z","title":"Worldcoder, a model-based llm agent: Building world models by writing code and interacting with the environment.arXiv preprint arXiv:2402.12275, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.423844Z"},"links":{"cited_paper":"/paper/2402.12275","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:c57f326ffd29ab66e8e78f350dcb198bd6c50ec570e7f8e75c3a0d51f362fbac","observation_id":"138c330b-e603-41c1-9383-3aebb683c63d","resolution":{"observed_at":"2026-08-08T21:45:45.423844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-08T21:45:45.428515Z","title":"Gemma: Open models based on gemini research and technology.arXiv preprint arXiv:2403.08295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.428515Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:829ca2b4e8ce5b7223a7470c3dfcba900e0e266cb5da338c9d4b9c38e32b3837","observation_id":"02887bf2-501d-4228-854e-948372ef04ff","resolution":{"observed_at":"2026-08-08T21:45:45.428515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.602288Z","title":"Planbench: An extensible benchmark for evaluating large language models on planning and reasoning about change","venue":null,"work_id":"f45fb832-2389-4f3a-a832-1ab34947dbed","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.433859Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:9d5aa0414b3305fdcfa58f7dfe798af0ec32c1cfc62350987df037b8b9bb21cd","observation_id":"320494a9-972c-4a9b-aaf3-4c3a54ad206c","resolution":{"observed_at":"2026-08-08T21:45:46.607314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-07-06T19:18:41.002837Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T21:45:45.438262Z","title":"Llms still can’t plan; can lrms? a preliminary evaluation of openai’s o1 on planbench.arXiv preprint arXiv:2409.13373, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.438262Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:44be7e87208d42746cb538c76d5e89ee1c135da35999e1bec9721675c82ae666","observation_id":"d1ec938e-c08e-4c54-8447-311a147ecf4c","resolution":{"observed_at":"2026-08-08T21:45:45.438262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19924","last_updated":"2024-10-14T03:41:09Z","snapshot_observed_at":"2026-07-06T19:24:17.628876Z","submitted_at":"2024-09-30T03:58:43Z","title":"On The Planning Abilities of OpenAI's o1 Models: Feasibility, Optimality, and Generalizability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19924","snapshot_observed_at":"2026-08-08T21:45:45.447954Z","title":"On the planning abilities of openai’s o1 models: Feasibility, optimality, and generalizability.ArXiv, abs/2409.19924, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.447954Z"},"links":{"cited_paper":"/paper/2409.19924","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:ff951172062af938fcb6aa45c83cc102ba5b2d2d349cf0407216154db4444d8e","observation_id":"03ae988b-5ada-4c24-970e-d209af5d3491","resolution":{"observed_at":"2026-08-08T21:45:45.447954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-08T21:45:45.452286Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.452286Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:20a2459b686c60bb1879b6a6d8c31f2ea71fe4e745a4de4147603e9028e7155a","observation_id":"2b2e7a1c-ce55-4a01-8229-9cd14def1877","resolution":{"observed_at":"2026-08-08T21:45:45.452286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-08T21:45:45.457229Z","title":"Emergent abilities of large language models.arXiv preprint arXiv:2206.07682, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.457229Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:5a47aeda91297c9d0ae54c4cc8d7197999f2eef72e5037c0c93d9573ebb324c7","observation_id":"26aedf24-c089-4a68-a1c2-24a2e02fbdb8","resolution":{"observed_at":"2026-08-08T21:45:45.457229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.587639Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"2bda2ac9-ffd9-4cf7-87d5-07561ed7b59a","year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.461751Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:b270a282611f59a6b2843b32c44757dea145f2c97b019291f41b47dd1d50e47c","observation_id":"7e4dc49f-163a-48a8-ad00-e8ea8df8ae46","resolution":{"observed_at":"2026-08-08T21:45:46.592486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11829","last_updated":"2023-11-20T15:04:50Z","snapshot_observed_at":"2026-07-06T16:49:58.524003Z","submitted_at":"2023-11-20T15:04:50Z","title":"System 2 Attention (is something you might need too)","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11829","snapshot_observed_at":"2026-08-08T21:45:45.466137Z","title":"System 2 attention (is something you might need too).arXiv preprint arXiv:2311.11829, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.466137Z"},"links":{"cited_paper":"/paper/2311.11829","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:a456154691396ff2d458d608dacc4034f28ac810e0049058577db92515ff7619","observation_id":"b7151f06-4a35-470d-95bf-a263b660de2d","resolution":{"observed_at":"2026-08-08T21:45:45.466137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04344","last_updated":"2025-02-14T09:51:46Z","snapshot_observed_at":"2026-08-09T13:35:45.821715Z","submitted_at":"2024-06-06T17:59:56Z","title":"Verbalized Machine Learning: Revisiting Machine Learning with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04344","snapshot_observed_at":"2026-08-08T21:45:45.470962Z","title":"Verbalized machine learning: Revisiting machine learning with language models.arXiv preprint arXiv:2406.04344, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.470962Z"},"links":{"cited_paper":"/paper/2406.04344","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:d1e3efcf72e52868e7f1b4e29612ce6b7c939d55c73215f1f1996a018e82ee6d","observation_id":"1045e54b-a72d-44d0-a6ec-35c66fa8dbae","resolution":{"observed_at":"2026-08-08T21:45:45.470962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-08T21:45:45.475667Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.475667Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:b0023252bbb9b7408f36f39ae2fafd64e6b1f4eed0cb73e49e9e0864137d9176","observation_id":"670baf85-dec8-40a9-8b0a-1045fe5539a2","resolution":{"observed_at":"2026-08-08T21:45:45.475667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.571454Z","title":"Le, Denny Zhou, and Xinyun Chen","venue":null,"work_id":"59b02ffc-cfc2-4afd-aa4a-abb0fcbe8b2d","year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.480493Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:a6bc29e7108be9481ed22038deaa0c18bdad88b6937b5727cd3de69f5fc55864","observation_id":"0db9d5d2-2838-4684-adc7-5b4f1e931cde","resolution":{"observed_at":"2026-08-08T21:45:46.576067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-08T21:45:45.484908Z","title":"Yi: Open foundation models by 01","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.484908Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:797cf25ca2ba6707e3b13666290e13d04ce4e35345ba93f66c08977ac0616caa","observation_id":"5d3b7035-f87b-412a-b727-b261da42ae26","resolution":{"observed_at":"2026-08-08T21:45:45.484908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06023","last_updated":"2024-07-24T18:40:36Z","snapshot_observed_at":"2026-07-31T10:52:02.949801Z","submitted_at":"2024-07-08T15:17:46Z","title":"Distilling System 2 into System 1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06023","snapshot_observed_at":"2026-08-08T21:45:45.489671Z","title":"Distilling system 2 into system 1.arXiv preprint arXiv:2407.06023, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.489671Z"},"links":{"cited_paper":"/paper/2407.06023","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:90a32efb47a6a206027e2d1d22a147f954513317bc29ced625293f75c9009d1f","observation_id":"41055a6c-f42a-4147-ae5f-31763f762d3b","resolution":{"observed_at":"2026-08-08T21:45:45.489671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-07-06T18:29:04.294349Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-08T21:45:45.494452Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.494452Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:0501d8d1387b710f772b388395528cc58d3bd2ad46f28121489794f08ac83b7f","observation_id":"cb0d4312-531b-41b3-a5bd-24554ff9ce11","resolution":{"observed_at":"2026-08-08T21:45:45.494452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14135","last_updated":"2024-12-18T18:24:47Z","snapshot_observed_at":"2026-08-03T23:00:22.560900Z","submitted_at":"2024-12-18T18:24:47Z","title":"Scaling of Search and Learning: A Roadmap to Reproduce o1 from Reinforcement Learning Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14135","snapshot_observed_at":"2026-08-08T21:45:45.499263Z","title":"Scaling of search and learning: A roadmap to reproduce o1 from reinforcement learning perspective.arXiv preprint arXiv:2412.14135, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.499263Z"},"links":{"cited_paper":"/paper/2412.14135","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:7ec62bdba894de4c0d16e88f87db83302c432496f129b1f3f7bdc121dcae0182","observation_id":"e390a31d-ece3-4680-8602-4e9b7f4b24a3","resolution":{"observed_at":"2026-08-08T21:45:45.499263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-08T21:45:45.504109Z","title":"Generative verifiers: Reward modeling as next-token prediction.arXiv preprint arXiv:2408.15240, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.504109Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:d66cf2a15368e3b4a771da8004f872a5983df5f61f064dcd3e97415074d9f0b8","observation_id":"0135e484-0cab-4eed-8cc7-889552487b0a","resolution":{"observed_at":"2026-08-08T21:45:45.504109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-09T06:26:57.793642Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-08-08T21:45:45.509398Z","title":"Minif2f: a cross-system benchmark for formal olympiad-level mathematics","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.509398Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:32ce5d33f4c7d504a34452179a14d3c3d81e7c0208f7202a6d243b1941d2bc58","observation_id":"e9755324-e6a7-4746-9e07-35f758271294","resolution":{"observed_at":"2026-08-08T21:45:45.509398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.555428Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":"5cf61686-5dae-4c5e-b0fc-514da2bf3111","year":2023},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.515011Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:9f342561a51e40d4a2fa5e1e268de9fb25f864dca66309b4077a0ad1196dcd90","observation_id":"f78d30ca-a71c-44cf-bfd8-29d54df6cd81","resolution":{"observed_at":"2026-08-08T21:45:46.561071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01910","last_updated":"2023-03-10T17:20:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-03T15:43:03Z","title":"Large Language Models Are Human-Level Prompt Engineers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01910","snapshot_observed_at":"2026-08-08T21:45:45.519535Z","title":"Large language models are human-level prompt engineers.arXiv preprint arXiv:2211.01910, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.519535Z"},"links":{"cited_paper":"/paper/2211.01910","citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:f3d58c71027d2c06b1233269a8143d14f9a40ff4115682e9360639a703c3da53","observation_id":"ac2a8a49-3c8e-4897-92cb-edec6482a32d","resolution":{"observed_at":"2026-08-08T21:45:45.519535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:45.524359Z","title":"Plane- tarium: A rigorous benchmark for translating text to structured planning languages.arXiv preprint arXiv:2407.03321, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.524359Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:f816c8202eeb017cb0151fd88b1e2ca29e2a7d247f80139f4c1dbf2903a93b17","observation_id":"0017a679-4b3c-4983-9544-091018a6b5b0","resolution":{"observed_at":"2026-08-08T21:45:45.524359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.540298Z","title":"object1 is washed and heated","venue":null,"work_id":"f443c58f-7496-4fe2-ae61-f8dab3b0161e","year":2025},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.529282Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:99870ad0776f47ad7f6aaaf5dee54e6c7c5955378060319f9fddf8adfdfe89b8","observation_id":"87adb92d-79da-48f4-b24a-c65f2c4e2186","resolution":{"observed_at":"2026-08-08T21:45:46.545188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.524092Z","title":null,"venue":null,"work_id":"6ec57ab5-9bdc-4632-81f7-23a2894d2976","year":null},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.534417Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:4a9e094f8a4f94e7646dd4afa5f33d4fc0b9816a57566d1febee61c9e9713f4f","observation_id":"f993925a-28f3-40d8-bf4f-44d289741275","resolution":{"observed_at":"2026-08-08T21:45:46.528926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T21:45:46.508147Z","title":null,"venue":null,"work_id":"810dc7e8-048d-488f-9c6e-1fcd413f0112","year":2025},"citing_paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T21:45:45.538720Z"},"links":{"citing_paper":"/paper/2502.04728"},"observation_digest":"sha256:abf47c25bc031eb1a02c41c69745355e24d0d797010b1454ab3a94d440ede749","observation_id":"6022571f-e1b0-4246-8129-db0ae523b999","resolution":{"observed_at":"2026-08-08T21:45:46.513526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.04728","last_updated":"2025-05-08T13:42:18Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T13:36:05.810490Z","submitted_at":"2025-02-07T07:52:25Z","title":"Generating Symbolic World Models via Test-time Scaling of Large Language Models"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 3 inbound Pith citation observations for arXiv:2502.04728."}