{"as_of":"2026-08-05T20:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1ad1d3b41e712b79852aff368eebe85a581227c50fd179421e6350a6348c8cee","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T09:47:04.122464Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.11816/citation-record","integrity":"/paper/2606.11816/integrity","json":"/paper/2606.11816/citation-record.json","paper":"/paper/2606.11816"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2022 , booktitle=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:6ec142bfe26f3440c7db5c2c90a68322662ed565c9750cd689ccab01ed063fdf","observation_id":"76230b58-d6e9-4103-9c32-2283fd57a154","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:747278cb5470cd35e65c29f84d9852c3765bd81d5aa83894cabda2164ba8da73","observation_id":"d78c7011-b4d5-4f58-a32b-15396f2b7535","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2023 , booktitle=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:49fdb111731097ffed64cc62f851dee470a6c62b28a9c1216d9f85a036efd67c","observation_id":"41fc2712-91e5-4a64-8b56-1789e12b1f16","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:072129d39eb5b576df997147dfd40669518bc4d1319057dbaed27301289d5691","observation_id":"0f47a672-d2dd-4056-bf7c-8c653c8f6227","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:7c26d3aa5eb7e64f227cdd33631bef0118735b04f248993b0ac741c624d4d909","observation_id":"cf47892a-37ca-4f3c-8956-5ca778121a45","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:7f75f35fbf4c760bf14320906bf65f71e5317b607481334a5ff38b6ba124d3f9","observation_id":"4073cd05-cb24-4a3c-af0c-cb34462874cb","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:084b9f1feff02cd99109eb90f66be0ccec5adf89710dc49d98bfb3731552d5c5","observation_id":"13c9efb7-3b9d-4ce7-b377-54b15bc56fec","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:05b1b52c4a3afa0a1ea9ab6db263faa94006a6d88c7072c5e5ce21b85045b5e9","observation_id":"88bf4e0d-5d4d-4f5b-855f-220dc1cb45ad","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2024 , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:2be46d7202d17537afcd46fdda0a21ec496c5a6fcae0850545ad34d6b7b739be","observation_id":"8053b767-8a20-4daa-a528-74d02f51e9cf","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2024 , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:ba5c415b0467b61c735b125fd198188b7f9b17dad57dd4d6faf4aaa377064d5e","observation_id":"893e4bb9-00ca-401b-bac4-3dcd2351d030","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2024 , booktitle=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:3f9dfd973ee54beb8e6dd461092009e01d4c99c837740edff1cdd68e159167ba","observation_id":"35488357-89a7-4945-aecd-ee62aeb8ffe0","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:52ece3b2054607fd6d3059fdb56daeb3a2f525edf71ed04e94e9d0556388b3d4","observation_id":"1cf99f21-8b31-4f5e-ae84-8a4f7a51c0e7","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:f2e9693f2b0b438ffb1ad073a5babe6d78bddb687d86dab09d60fbbdad170259","observation_id":"6ffe18b6-c5b3-4afa-9fc7-a96e62c37521","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"Journal of Behavioral Decision Making , volume=","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:e01073d5c1f255e3e314e890523e67cb2283d0eddf36731c162c7ac207e005e1","observation_id":"d8bee4f1-ba96-496c-a1c5-16d2d44ab4fb","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"Ramnani and Mayuresh Anand and Shubhashis Sengupta and Andrew E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:83012a16c0373320fe2ef7377916198a9f052cde6787ad753a51474ee8e06d97","observation_id":"52e7e8e3-bcee-464d-bdde-48eeed1dfda1","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2023 , booktitle=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:535c6a4e5fc78010402792c19cad0d33cb7dc1818635a987db31e446dc01d110","observation_id":"e28d7a81-72f1-4a25-944e-503f86bc8e0d","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:cdf2b7bde240ecea53e20cef722a9917bb956b9c287a999e9427bb5be6d89e60","observation_id":"898d2ac3-3c4f-43cd-8db7-aa7a6dac8c35","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:8b768cea571aa152c71c4438c2702e806bd2a194c9c8ae08da6d2965538b3b00","observation_id":"29d3ecbf-a376-4432-a3c2-dfe82d258560","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:f14da7813ffdf0e5598b8715965363dd8b3c369999f31ee0603e3b6db7f2c638","observation_id":"9622fe35-1be2-414b-85db-5b82a7f12615","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":", booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:ae2df191eaf56290d3a88f81917ad2f9b469e1400b6d711b7c2639c9b9a9af9e","observation_id":"286b0ba0-0aae-44c6-a48d-f7a365d1c9ab","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"ForecastTKGQuestions: A Benchmark for Temporal Question Answering and Forecasting over Temporal Knowledge Graphs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:83db3ae3d84b74dff49e0d45a768625d520ed7ffa64993ef2963cd4d3e8af6ab","observation_id":"d10e56ba-7de7-496e-b7ad-6f43cb5879cf","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1423","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERT : Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"Proceedings of the 2019 Conference of the North","work_id":"3e3c8ac8-b858-4b22-af32-393d98c883e0","year":2019},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:72c56a61380dfd395759bf3beec9440a1611422c9266ba9fec054ca450ef21bc","observation_id":"d98000fa-a14c-48b2-bc84-bf61a31f1c8e","resolution":{"observed_at":"2026-06-27T09:50:48.137102Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T13:38:13.85894+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T13:38:13.85894+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:d2135fd35f42f763b195469e797517c0374c75dbd80ff4743cf9d28735e77344","observation_id":"ce43e413-c15f-495c-8d1f-ef1483a0605c","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08324","last_updated":"2025-07-08T15:08:52Z","snapshot_observed_at":"2026-07-06T19:49:30.260410Z","submitted_at":"2024-11-13T04:20:20Z","title":"Are LLMs Prescient? A Continuous Evaluation using Daily News as the Oracle","version":2},"cited_work":{"arxiv_id":"2411.08324","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.08324","snapshot_observed_at":"2026-07-04T06:09:38.132161Z","title":null,"venue":null,"work_id":"faa50cc2-381d-417d-b04d-0bf16782e6ac","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2411.08324","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:61e60cac0bb2b4ddc58963d01b27c680b86d466487da9ee7718124fc7b63d91a","observation_id":"83620d71-1191-41d7-81c9-2878bd9c5b34","resolution":{"observed_at":"2026-07-03T10:58:02.652552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:2b0dd438e15a7b29bba392351e526df6c164a593e0dcc7cc3e5d66887ede0e43","observation_id":"b57a3ec0-f460-4c19-9234-395f07887415","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07820","last_updated":"2024-08-12T00:43:56Z","snapshot_observed_at":"2026-07-06T16:31:29.379540Z","submitted_at":"2023-10-11T19:01:28Z","title":"Large Language Models Are Zero-Shot Time Series Forecasters","version":3},"cited_work":{"arxiv_id":"2310.07820","doi":"10.48550/arxiv.2310.07820","metadata_source":"pith","pith_arxiv_id":"2310.07820","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large language models are zero-shot time series forecasters","venue":"cs.LG","work_id":"393b037b-184a-4ca9-addd-713285fc79d2","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2310.07820","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:a299871d97dcc2c174cafe3aa4174367538074e3dbbc6dca55cfa8ba40ab03b2","observation_id":"fced5b50-938c-42ca-bccb-7ecd02fe663c","resolution":{"observed_at":"2026-07-03T10:58:02.658392Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03200","last_updated":"2025-01-06T18:28:04Z","snapshot_observed_at":"2026-07-06T20:17:11.484017Z","submitted_at":"2025-01-06T18:28:04Z","title":"The FACTS Grounding Leaderboard: Benchmarking LLMs' Ability to Ground Responses to Long-Form Input","version":1},"cited_work":{"arxiv_id":"2501.03200","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03200","snapshot_observed_at":"2026-07-10T14:07:06.683844Z","title":"Jacovi, A","venue":"cs.CL","work_id":"4ec5c7b0-858c-49c0-9a5d-7c78bb7cf199","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2501.03200","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:57fefe95d825d7458cea481aea2538ecf1b68db7ff9cff603078e94932919df5","observation_id":"444372f9-e854-470e-a635-d21d90470b77","resolution":{"observed_at":"2026-07-03T10:58:02.663170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01728","last_updated":"2024-01-29T06:27:53Z","snapshot_observed_at":"2026-08-04T04:31:27.172482Z","submitted_at":"2023-10-03T01:31:25Z","title":"Time-LLM: Time Series Forecasting by Reprogramming Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.01728","doi":"10.48550/arxiv.2310.01728","metadata_source":"pith","pith_arxiv_id":"2310.01728","snapshot_observed_at":"2026-07-11T01:17:44.658229Z","title":"Time-LLM: Time Series Forecasting by Reprogramming Large Language Models","venue":"cs.LG","work_id":"e2b7aab4-6ed4-457b-9074-6fa4816dfdc2","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2310.01728","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:896901246642cf6a339d2df85b783fbd91ffcdc59e244a3f29eb3fb7dfd839ee","observation_id":"81780c1f-5a6b-46b8-bfa6-f38d468a1e6c","resolution":{"observed_at":"2026-07-03T10:58:02.659640Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:2ec178a948da7ae5e12be3ea4f0000d6ec60e4e061e6097544a42d873284ba64","observation_id":"5e4ac957-8140-47ce-8423-d5fb8e3f1cda","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13332","last_updated":"2024-02-28T07:45:37Z","snapshot_observed_at":"2026-07-06T13:35:47.057503Z","submitted_at":"2022-07-27T07:26:01Z","title":"RealTime QA: What's the Answer Right Now?","version":2},"cited_work":{"arxiv_id":"2207.13332","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.13332","snapshot_observed_at":"2026-07-03T10:58:02.645668Z","title":"Smith, Yejin Choi, and Kentaro Inui","venue":null,"work_id":"110b1ee6-6ecd-4815-b5ce-4009cf93b9fe","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2207.13332","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:a90acdd2afe3f02469cbd7568589159094e6c500090652601ee2a0ba3e5694f4","observation_id":"efb55a8c-9c5d-458d-9ae6-b5e451217b4b","resolution":{"observed_at":"2026-07-03T10:58:02.647009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T09:47:04.122464Z","title":"Ramnani, Mayuresh Anand, Shubhashis Sengupta, and Andrew E","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:4c3c1cd18a3abb78263f5bce3e11f30aeb4c09885103102b72cf046904311ba6","observation_id":"c5662c80-1290-4f54-962f-e887e3e5c8d2","resolution":{"observed_at":"2026-06-27T09:47:04.122464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10630","last_updated":"2026-06-03T16:47:53Z","snapshot_observed_at":"2026-07-06T21:41:00.113637Z","submitted_at":"2025-06-12T12:15:50Z","title":"Time Series Forecasting as Reasoning: A Slow-Thinking Approach with Reinforced LLMs","version":3},"cited_work":{"arxiv_id":"2506.10630","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.10630","snapshot_observed_at":"2026-07-04T08:19:44.584121Z","title":"Time Series Forecasting as Reasoning: A Slow-Thinking Approach with Reinforced LLMs","venue":"cs.LG","work_id":"8f765df2-7146-4c98-9a05-a6c9abafa223","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2506.10630","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:d5e06afec48602c2f2fb4ebaa888b24f453dddc7fa9b73aa64c0db82672f954a","observation_id":"dc88334a-bc36-48a0-a189-80e0e38ceee6","resolution":{"observed_at":"2026-07-03T10:58:02.662179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.741","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:37:06.726417Z","title":"Proceedings of the 2023","venue":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","work_id":"f952e39f-7d85-4a4f-9dd7-9da09cf2c1d8","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:50c78f114292318537475509e3c05e52dea7984f0b6293588a7bc5187d9fc2b2","observation_id":"2c83b60f-2bbf-4527-a194-a8e3e91e98b8","resolution":{"observed_at":"2026-06-27T09:50:48.142123Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:20:13.984389+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:20:13.984389+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.12870","last_updated":"2022-08-02T20:40:20Z","snapshot_observed_at":"2026-07-06T12:22:10.147936Z","submitted_at":"2021-12-23T22:33:20Z","title":"Measuring Attribution in Natural Language Generation Models","version":2},"cited_work":{"arxiv_id":"2112.12870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2112.12870","snapshot_observed_at":"2026-07-04T21:10:08.614527Z","title":"Rashkin, V","venue":null,"work_id":"3040f4f2-483f-4f73-b804-e82d4c74a380","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2112.12870","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:648d0a17e52051686e825ee74d3fb5961f45906fb518d152747c7d6b492f9105","observation_id":"86111039-4e4a-4cb7-8d4d-0d291f5f31b6","resolution":{"observed_at":"2026-07-03T10:58:02.657429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.940","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"20c57f7c-c8fb-4747-b7d7-4815a3edd373","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:39dea8a21e3acb58c32290f0437da06b12ce4c10faf2ac41999bf537e8203bc7","observation_id":"257e21ac-37e8-4070-b7f8-53d640d9d2c0","resolution":{"observed_at":"2026-06-27T09:50:48.139404Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.21558","last_updated":"2025-06-11T16:18:40Z","snapshot_observed_at":"2026-07-06T21:48:12.113972Z","submitted_at":"2025-06-11T16:18:40Z","title":"Bench to the Future: A Pastcasting Benchmark for Forecasting Agents","version":1},"cited_work":{"arxiv_id":"2506.21558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.21558","snapshot_observed_at":"2026-07-04T06:09:38.152990Z","title":"arXiv preprint arXiv:2506.21558 , year=","venue":null,"work_id":"d9eb8eb9-eb99-46b5-ba6f-05a05c571aa6","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2506.21558","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:823ebba4e08aac242120b39563860fe358d940c5a3fddd5478dbf00840885114","observation_id":"07a8b136-96c9-4270-8900-ea9e2f540c10","resolution":{"observed_at":"2026-07-03T10:58:02.649126Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14740","last_updated":"2023-10-23T10:35:30Z","snapshot_observed_at":"2026-07-06T15:32:14.701994Z","submitted_at":"2023-05-24T05:21:13Z","title":"ECHo: A Visio-Linguistic Dataset for Event Causality Inference via Human-Centric Reasoning","version":2},"cited_work":{"arxiv_id":"2305.14740","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.14740","snapshot_observed_at":"2026-07-03T10:58:02.637476Z","title":null,"venue":null,"work_id":"1d68c036-8d81-4d01-87d1-71882516423f","year":2023},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2305.14740","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:8429fe21a9de502899f63cbb1502a27d6810c7164175b44a0e7002c9eea7e41f","observation_id":"ea1dc406-87a8-44cf-86d9-c7439340b30b","resolution":{"observed_at":"2026-07-03T10:58:02.639448Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.17638","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:07:42.480846Z","title":"Cheng et al","venue":null,"work_id":"8d204a6f-a637-4d84-aff5-ba563f897cc6","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:bc48683e702acb7a391f569f482cd484e3a8e7fbf139049860c07fa2ee12026e","observation_id":"6adee730-89f9-449e-83cc-eac9dafb664b","resolution":{"observed_at":"2026-07-03T10:58:02.641873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01231","last_updated":"2024-07-01T12:22:46Z","snapshot_observed_at":"2026-07-06T18:39:29.270369Z","submitted_at":"2024-07-01T12:22:46Z","title":"MIRAI: Evaluating LLM Agents for Event Forecasting","version":1},"cited_work":{"arxiv_id":"2407.01231","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01231","snapshot_observed_at":"2026-07-11T00:07:42.400412Z","title":"Mirai: Evaluating llm agents for event forecasting","venue":"cs.CL","work_id":"41d14003-ac6d-4540-9050-9a29540d4377","year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2407.01231","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:e95e4d8538d31dd571373dcc0ceafd7ce31ab6ea2572b88bcc65c8389cb15f6b","observation_id":"56df8d54-f063-4907-b5ff-78a3e3137172","resolution":{"observed_at":"2026-07-03T10:58:02.665614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9334.364537","doi":"10.1145/3589334.3645373","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InProceedings of the ACM Web Conference 2024(Singapore, Singapore)(WWW ’24)","venue":null,"work_id":"84d514f4-da49-4ff3-984c-6c125ce35172","year":2024},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:e4f192839f61d3cb384811475e61e9c3745292d57997784d4ba0929566d9f2e0","observation_id":"efeb700d-2193-4c1c-9936-07b826cc6462","resolution":{"observed_at":"2026-06-27T09:50:48.134721Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19676","last_updated":"2025-05-16T15:08:20Z","snapshot_observed_at":"2026-07-06T20:43:27.023548Z","submitted_at":"2025-02-27T01:36:00Z","title":"FOReCAst: The Future Outcome Reasoning and Confidence Assessment Benchmark","version":4},"cited_work":{"arxiv_id":"2502.19676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.19676","snapshot_observed_at":"2026-07-03T10:58:02.659365Z","title":null,"venue":null,"work_id":"6cbf99e3-9bb7-4731-967c-3a29b48771d8","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2502.19676","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:bac14e58c94e24ab00410823f04ea8a4a58b1f72a70a9baa4ef8d56b2f6b935d","observation_id":"974182e4-13b6-4d6f-947e-e8bd9afb1c85","resolution":{"observed_at":"2026-07-03T10:58:02.660619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11987","last_updated":"2025-09-05T09:15:55Z","snapshot_observed_at":"2026-08-05T19:39:12.827378Z","submitted_at":"2025-08-16T08:54:08Z","title":"FutureX: An Advanced Live Benchmark for LLM Agents in Future Prediction","version":3},"cited_work":{"arxiv_id":"2508.11987","doi":"10.48550/arxiv.2508.11987","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.11987","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Futurex: An advanced live benchmark for llm agents in future prediction","venue":"ArXiv.org","work_id":"ac497801-1ebb-45ae-8286-d566aec17d80","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2508.11987","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:cc9f88b5a04814a4630375210de78c5479b90c00aabf667650efea0fba0553a5","observation_id":"8c22fc98-30b1-46c3-bb82-0facb0491dc9","resolution":{"observed_at":"2026-07-03T10:58:02.668078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.naacl-long.381","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Is Your LLM Outdated? A Deep Look at Temporal Generalization","venue":null,"work_id":"24d5e0d2-eacc-4641-a7a0-9c612ac32e3c","year":2025},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:be9ecd5525728ca70e8668776843bb4bc81c575e9f3c467f5de27f8d212ba39f","observation_id":"7428a9ae-35b1-464b-b8ef-30d2dfd2f441","resolution":{"observed_at":"2026-06-27T09:50:48.140762Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T08:53:22.980233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T08:53:22.980233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.15474","last_updated":"2022-10-09T23:32:19Z","snapshot_observed_at":"2026-07-06T13:26:33.250328Z","submitted_at":"2022-06-30T17:59:14Z","title":"Forecasting Future World Events with Neural Networks","version":2},"cited_work":{"arxiv_id":"2206.15474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.15474","snapshot_observed_at":"2026-07-03T10:58:02.669131Z","title":"arXiv preprint arXiv:2206.15474 , year=","venue":null,"work_id":"6cb8f2e6-76cd-4898-b6d8-812659ec3a9d","year":2022},"citing_paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-27T09:47:04.122464Z"},"links":{"cited_paper":"/paper/2206.15474","citing_paper":"/paper/2606.11816"},"observation_digest":"sha256:98a50fb33f3c41068ad275e173a92ab95e8683f10d67452e28ee56c5f35f1063","observation_id":"d229ea84-9cf2-4a51-a485-c325dcb1b1bd","resolution":{"observed_at":"2026-07-03T10:58:02.671142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.11816","last_updated":"2026-06-10T08:50:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:50:49.040880Z","submitted_at":"2026-06-10T08:50:29Z","title":"WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":25,"verified_exact":16,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2606.11816."}