{"as_of":"2026-08-17T21:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:329bed4388be1718685235e606b7d8f2591207a52e78357da5222d5c159b1a20","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:12:01.571261Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:36:44.033596Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T14:25:46.619265Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"cited_work":{"arxiv_id":"2505.10543","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10543","snapshot_observed_at":"2026-07-01T14:25:46.619265Z","title":"Reasoning capabilities of large language models on dynamic tasks.arXiv preprint arXiv:2505.10543, 2025","venue":null,"work_id":"811ff774-b6c2-4cbc-84fc-7c8f5bd7db27","year":2025},"citing_paper":{"arxiv_id":"2605.23972","last_updated":"2026-05-13T12:55:34Z","snapshot_observed_at":"2026-08-17T14:17:06.960457Z","submitted_at":"2026-05-13T12:55:34Z","title":"Why We Need World Models for AGI: Where LLMs Fail and How World Models May Outperform","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T21:36:44.033596Z"},"links":{"cited_paper":"/paper/2505.10543","citing_paper":"/paper/2605.23972"},"observation_digest":"sha256:797bde81a06a31828e7d96b2c28491113128333da7ae228aef7d1443b07a09fb","observation_id":"82031c4c-49ec-4ff8-99a9-b8e562076058","resolution":{"observed_at":"2026-07-01T14:25:46.621005Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.10543/citation-record","integrity":"/paper/2505.10543/integrity","json":"/paper/2505.10543/citation-record.json","paper":"/paper/2505.10543"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.466773Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.466773Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:daef8e80725ee13c6823738fe6bb7375dcea4f3d567bc2f11ca5b30206c09a05","observation_id":"775d0281-04ef-4006-b35f-d0d7237facb2","resolution":{"observed_at":"2026-08-15T21:12:01.466773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.471784Z","title":"Reflex- ion: Language agents with verbal reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.471784Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:23390a5be527eb2259d3750d0d542aca760f430cdb2f562e224a1a74d3042319","observation_id":"ca51aa6e-73d8-4458-87c9-cb654602f008","resolution":{"observed_at":"2026-08-15T21:12:01.471784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-08-15T21:12:01.477653Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.477653Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:306a346935196a2fc72f8590402fd0873cf045bca8a9e47897a1368a0ee5993a","observation_id":"5d6b2e2a-80bf-4586-a364-39ea9594b2ec","resolution":{"observed_at":"2026-08-15T21:12:01.477653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-08-17T06:15:32.510873Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-15T21:12:01.483633Z","title":"The rise and potential of large language model based agents: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.483633Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:80437c224ad7e36b506302d65d48d8d7a325a441639d0a4617eaa5bc92c2245f","observation_id":"0ff6ec71-be91-42a3-8f17-8315825a5e20","resolution":{"observed_at":"2026-08-15T21:12:01.483633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.974658Z","title":"Text-based games as a challenging benchmark for large language models,","venue":null,"work_id":"0ef3e960-82a9-44e4-aec0-e4b4b676221c","year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.488755Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:0cc665e2f9c8cc93526eb43c4b8bfd93be0870be72a80dc9095980d9683254c7","observation_id":"397d00e7-3ba5-429e-a182-d106554c23df","resolution":{"observed_at":"2026-08-15T21:12:01.979481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.493247Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.493247Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:022e56836453d5926c925bc99e3ac049b72c8728e072c0866e5d0d3a63bfc232","observation_id":"1f7aa33f-e1db-4eb1-b571-debb7e5e8640","resolution":{"observed_at":"2026-08-15T21:12:01.493247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.498450Z","title":"Prompt programming for large language models: Beyond the few-shot paradigm,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.498450Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:54b4f9bab9e34fb27d3fb77cd01b668f0face6b0dfb90d8a0ec10bde5eaae38e","observation_id":"ba4a0d14-a25e-4426-9429-0b67fc784714","resolution":{"observed_at":"2026-08-15T21:12:01.498450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01557","last_updated":"2024-03-17T23:23:31Z","snapshot_observed_at":"2026-08-16T19:41:52.614571Z","submitted_at":"2023-10-02T18:52:11Z","title":"SmartPlay: A Benchmark for LLMs as Intelligent Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01557","snapshot_observed_at":"2026-08-15T21:12:01.502630Z","title":"Smartplay: A benchmark for llms as intelligent agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.502630Z"},"links":{"cited_paper":"/paper/2310.01557","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:8bd2af66b5bc7319b1c8a7bd27a3cdee825dc4d955c5d4f550d26da02259789c","observation_id":"564526f6-4b44-4d2e-9eb5-c1230ed93105","resolution":{"observed_at":"2026-08-15T21:12:01.502630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.507211Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.507211Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:74448cb89544eea99e2a96264e8b6fb676b4ce9210cb411d54a40b52ca7a971c","observation_id":"ac619244-a0bb-40b6-a592-7810617ec795","resolution":{"observed_at":"2026-08-15T21:12:01.507211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.511339Z","title":"Self-refine: Iter- ative refinement with self-feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.511339Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:7709ee012b553fff8239a16a04080c2e065e7caa6f95f4a0bed838d91d9034a5","observation_id":"50feaa8f-be13-44e6-a508-f20848d88d13","resolution":{"observed_at":"2026-08-15T21:12:01.511339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17574","last_updated":"2024-06-06T18:40:47Z","snapshot_observed_at":"2026-08-17T17:20:50.978981Z","submitted_at":"2024-02-27T15:09:20Z","title":"Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17574","snapshot_observed_at":"2026-08-15T21:12:01.515887Z","title":"Agent-pro: Learning to evolve via policy-level reflection and optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.515887Z"},"links":{"cited_paper":"/paper/2402.17574","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:bf33628b1e1c17c858e4b66003637937dd2ad41b7b9242d61e3c7fc531213448","observation_id":"0259a033-897e-4c0e-8a1c-2a357cedce90","resolution":{"observed_at":"2026-08-15T21:12:01.515887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15064","last_updated":"2023-10-26T16:44:39Z","snapshot_observed_at":"2026-08-16T15:30:11.683917Z","submitted_at":"2023-05-24T11:52:23Z","title":"AutoPlan: Automatic Planning of Interactive Decision-Making Tasks With Large Language Models","version":3},"cited_work":{"arxiv_id":"2305.15064","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.15064","snapshot_observed_at":"2026-08-15T21:12:01.726740Z","title":"AutoPlan: Automatic Planning of Interactive Decision-Making Tasks With Large Language Models","venue":"cs.CL","work_id":"3d73efa6-116b-4d9d-9a9e-308f8f70fc5a","year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.520534Z"},"links":{"cited_paper":"/paper/2305.15064","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:d885d03b4a3c5b6b5c3fd6dd559b70b3a1c77108f312476479e51c978de9c8e9","observation_id":"b6cafd80-2a29-4413-8728-be1593027a34","resolution":{"observed_at":"2026-08-15T21:12:01.733559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01560","last_updated":"2024-07-08T05:56:47Z","snapshot_observed_at":"2026-08-02T14:50:04.461434Z","submitted_at":"2023-02-03T06:06:27Z","title":"Describe, Explain, Plan and Select: Interactive Planning with Large Language Models Enables Open-World Multi-Task Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01560","snapshot_observed_at":"2026-08-15T21:12:01.524931Z","title":"De- scribe, explain, plan and select: Interactive planning with large lan- guage models enables open-world multi-task agents,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.524931Z"},"links":{"cited_paper":"/paper/2302.01560","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:8b7cb6818812b0c83ec279288de497c083c6774cf93c512eb7ecd5cde77abdc0","observation_id":"377af352-bb2d-4d06-9771-d332ad7d3e72","resolution":{"observed_at":"2026-08-15T21:12:01.524931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18505","last_updated":"2024-06-26T17:14:45Z","snapshot_observed_at":"2026-08-16T13:39:21.344129Z","submitted_at":"2024-06-26T17:14:45Z","title":"Mental Modeling of Reinforcement Learning Agents by Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18505","snapshot_observed_at":"2026-08-15T21:12:01.529561Z","title":"Mental modeling of reinforcement learning agents by language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.529561Z"},"links":{"cited_paper":"/paper/2406.18505","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:05779d3f9ab44e5b2b7af102682afb80195ea05709a463e3cbf5891becff6a16","observation_id":"4b535f04-ce16-415b-bc38-e7c19f0013d8","resolution":{"observed_at":"2026-08-15T21:12:01.529561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08532","last_updated":"2025-05-01T11:56:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-15T16:50:09Z","title":"EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08532","snapshot_observed_at":"2026-08-15T21:12:01.534625Z","title":"Connecting large language models with evolution- ary algorithms yields powerful prompt optimizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.534625Z"},"links":{"cited_paper":"/paper/2309.08532","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:ba50fcb8cea4e0aad495ca9d731abd10c6f4b75ad4d6598d063b06acd41ae664","observation_id":"62adbb95-fe10-4f37-be0c-6b79d85bdc0a","resolution":{"observed_at":"2026-08-15T21:12:01.534625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.920147Z","title":"Llamea: A large language model evolutionary algorithm for automatically generating metaheuristics,","venue":null,"work_id":"7f1c5037-1368-48bc-81d9-313dd25e71c4","year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.539176Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:0238705c2c2607d6b4d303f739a8accefe4b093883bc9049a9d81890dd4a65f4","observation_id":"db7d2981-7220-4eb8-b4f8-d329ee8e128b","resolution":{"observed_at":"2026-08-15T21:12:01.925131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.866224Z","title":"Focused transformer: Contrastive training for context scaling,","venue":null,"work_id":"f707a52d-ae0e-4c84-903b-622b138a2899","year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.543682Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:214d96c56ce806ed4e98a110acd8d8495645ee0b9786f20a08bb9c1b531c1b68","observation_id":"9d576973-9a70-4cc9-9ba4-d9da422eac3b","resolution":{"observed_at":"2026-08-15T21:12:01.909695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-15T21:12:01.547721Z","title":"Lost in the middle: How language models use long contexts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.547721Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:ab7268b2252f09a6e19e7bb237d7141b0c9472cf4748461698b007539572ad53","observation_id":"e1a413d7-8a89-420c-928b-dfd617713924","resolution":{"observed_at":"2026-08-15T21:12:01.547721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-15T21:12:01.552813Z","title":"Do not think that much for 2+3=? on the overthinking of o1-like llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.552813Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:70bb11da405b6dbbd03d40d452c95b6e1240c54c4e4ecca39ed78f45d8a78f57","observation_id":"528de17c-6008-4c33-b393-b4b9f20b0797","resolution":{"observed_at":"2026-08-15T21:12:01.552813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:12:01.804112Z","title":"Chain of thought- lessness? an analysis of cot in planning,","venue":null,"work_id":"c589abc5-d262-4c46-9f9b-f441df382ee4","year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.557485Z"},"links":{"citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:ffe5bccf274664bc37d1c8e3ec3f721896a80de3068750e8561fd589f484ed4d","observation_id":"937adfb6-0f8f-40dc-aed3-cc8084c7ca7d","resolution":{"observed_at":"2026-08-15T21:12:01.819066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06514","last_updated":"2025-04-11T02:36:28Z","snapshot_observed_at":"2026-08-16T12:42:51.166855Z","submitted_at":"2025-04-09T01:25:27Z","title":"Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06514","snapshot_observed_at":"2026-08-15T21:12:01.562040Z","title":"Missing premise exacerbates overthinking: Are reasoning models losing critical thinking skill?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.562040Z"},"links":{"cited_paper":"/paper/2504.06514","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:74d849c2cf02322abbcdc6281bd4cb76266caa9a001ea1bc3fcef9e974fe2765","observation_id":"6b30c080-4519-49ea-ae4d-2a4feb7e57d4","resolution":{"observed_at":"2026-08-15T21:12:01.562040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-17T01:54:11.006899Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-15T21:12:01.566767Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.566767Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:ed871797a21aa1bdbb2e5b61c48316589151c40c45095d0af3bd33ff68375813","observation_id":"a1c75472-7ada-44f0-b4fb-ed9f59678d52","resolution":{"observed_at":"2026-08-15T21:12:01.566767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13543","last_updated":"2025-04-01T14:45:22Z","snapshot_observed_at":"2026-08-17T20:50:49.728665Z","submitted_at":"2024-11-20T18:54:32Z","title":"BALROG: Benchmarking Agentic LLM and VLM Reasoning On Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13543","snapshot_observed_at":"2026-08-15T21:12:01.571261Z","title":"Balrog: Bench- marking agentic llm and vlm reasoning on games,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:12:01.571261Z"},"links":{"cited_paper":"/paper/2411.13543","citing_paper":"/paper/2505.10543"},"observation_digest":"sha256:c31f1af761adb9cd1dbcb02b4b24e96e1acee6a182a87ed08c29f8c9f8e5ceac","observation_id":"f0664dfa-eb55-42ae-9c61-6d5a51f64d30","resolution":{"observed_at":"2026-08-15T21:12:01.571261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.10543","last_updated":"2025-08-10T18:28:40Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T19:42:23.297471Z","submitted_at":"2025-05-15T17:53:47Z","title":"Reasoning Capabilities of Large Language Models on Dynamic Tasks"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2505.10543."}