{"as_of":"2026-08-08T07:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5b8185b063d16836b749b8ce99c165fdce4315542a51ee86efe957377330015","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:17:12.652475Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:31:04.379362Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T04:31:04.760758Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.19533","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19533","snapshot_observed_at":"2026-08-08T04:31:04.760758Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","venue":"cs.LG","work_id":"52567b85-577a-479d-be2f-fb234b1b2eac","year":2025},"citing_paper":{"arxiv_id":"2608.02985","last_updated":"2026-08-04T00:45:54Z","snapshot_observed_at":"2026-08-08T04:19:18.723440Z","submitted_at":"2026-08-04T00:45:54Z","title":"Temporal Leakage in LLM Backtesting: Measurement, Validation, and Adjusted Scores","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T04:31:04.379362Z"},"links":{"cited_paper":"/paper/2505.19533","citing_paper":"/paper/2608.02985"},"observation_digest":"sha256:8b3ad52d26f247948d29a38109eeb38465e0621704dcb17f2ee21c43c557c4fe","observation_id":"34e6a539-1707-4c8c-83d1-cb68f3072666","resolution":{"observed_at":"2026-08-08T04:31:04.765917Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19533/citation-record","integrity":"/paper/2505.19533/integrity","json":"/paper/2505.19533/citation-record.json","paper":"/paper/2505.19533"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:17:05.108848Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.108848Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:1483153e5094c23fa2edef5fd2942040c8192d1957b03b13cd8cea3f177aef03","observation_id":"9ad88fed-bf98-420c-b4d2-635b148448de","resolution":{"observed_at":"2026-08-07T14:17:05.108848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.996141Z","title":"Anthropic","venue":null,"work_id":"3934422d-8dc8-4346-a791-4d18ebb30a35","year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.176279Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:091e5b0f4887d68147742083d68a19ebb84b1efe3ebb30a241c0b4cae64b4bf3","observation_id":"c69d35fa-270d-4c08-b121-caf541713f51","resolution":{"observed_at":"2026-08-07T14:17:19.101242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07738","last_updated":"2025-02-09T08:15:44Z","snapshot_observed_at":"2026-07-06T17:58:52.016903Z","submitted_at":"2024-04-11T13:36:29Z","title":"ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07738","snapshot_observed_at":"2026-08-07T14:17:05.293825Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.293825Z"},"links":{"cited_paper":"/paper/2404.07738","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:042e670510b26a11fdfff6606d5a27553e8a46a4cffb6e08ab80731bc5ecdfa0","observation_id":"4254cc86-41e6-45da-98e5-14cd09481235","resolution":{"observed_at":"2026-08-07T14:17:05.293825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:05.425118Z","title":"Brown, B","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.425118Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:4fe99712f67a969c862e1277b54ab18d691bb4607f3972eba78b01b0f1e7e215","observation_id":"49593271-7381-43e0-8205-795a4aef379b","resolution":{"observed_at":"2026-08-07T14:17:05.425118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06314","last_updated":"2021-10-25T01:10:38Z","snapshot_observed_at":"2026-08-07T12:53:09.497819Z","submitted_at":"2021-08-13T16:42:25Z","title":"A Dataset for Answering Time-Sensitive Questions","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06314","snapshot_observed_at":"2026-08-07T14:17:05.536574Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.536574Z"},"links":{"cited_paper":"/paper/2108.06314","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:48b004c3e45a33f2409f65fe702bf094a26c82fd847efc6bc17cf2fac03f867c","observation_id":"1058b819-ded4-4506-a282-191c8730e622","resolution":{"observed_at":"2026-08-07T14:17:05.536574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12958","last_updated":"2024-09-17T17:25:40Z","snapshot_observed_at":"2026-08-04T22:48:21.359909Z","submitted_at":"2024-03-19T17:57:58Z","title":"Dated Data: Tracing Knowledge Cutoffs in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12958","snapshot_observed_at":"2026-08-07T14:17:05.680565Z","title":"Cheng, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.680565Z"},"links":{"cited_paper":"/paper/2403.12958","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:b6fccc3729377ddd56020070a91997bf821fd2093f45a7665169dde8f63a10da","observation_id":"ac35d49a-adfc-4056-b28c-1824edb43ac5","resolution":{"observed_at":"2026-08-07T14:17:05.680565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:05.803408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.803408Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:430a7dd9978c70572e99da7f4b61a6caf27c5cda08670da62454a8802113a889","observation_id":"1b10d0fa-21af-4592-adac-dbc6dcc9a86c","resolution":{"observed_at":"2026-08-07T14:17:05.803408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11901","last_updated":"2024-08-21T22:54:47Z","snapshot_observed_at":"2026-07-06T17:46:25.142387Z","submitted_at":"2024-03-18T16:01:42Z","title":"Larimar: Large Language Models with Episodic Memory Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11901","snapshot_observed_at":"2026-08-07T14:17:05.917253Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:05.917253Z"},"links":{"cited_paper":"/paper/2403.11901","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:f411ad1bf1c6dd366553d6b57df5fd8246c68c90c18c4bb3ebc78910a6552852","observation_id":"facf1e9f-4ac9-4f4f-9708-29750f17cd37","resolution":{"observed_at":"2026-08-07T14:17:05.917253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.793233Z","title":null,"venue":null,"work_id":"1f3e09c8-b005-477b-a593-2618e1f36dfe","year":2025},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.022286Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:267a149d8e91805c6c074d675612f54ed3e9a8204b42469fe483be14863c28a7","observation_id":"9e1607da-5b02-4659-830a-e1eb428ef0fb","resolution":{"observed_at":"2026-08-07T14:17:18.876080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:17:06.146691Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.146691Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:f942dab2e56292049ec2186233ba018983fe30a36d84a4d3488d15c39cda7891","observation_id":"edbc648e-313a-4223-bf87-68dcea9aae09","resolution":{"observed_at":"2026-08-07T14:17:06.146691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09170","last_updated":"2024-06-13T14:31:19Z","snapshot_observed_at":"2026-07-06T18:30:19.486766Z","submitted_at":"2024-06-13T14:31:19Z","title":"Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09170","snapshot_observed_at":"2026-08-07T14:17:06.234436Z","title":"Fatemi, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.234436Z"},"links":{"cited_paper":"/paper/2406.09170","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:7f744b53e93675712835227a5adf37facc07a0b075a387be338abe1e3bab53e9","observation_id":"936d4ef5-3030-4be6-aaef-a88066aa067a","resolution":{"observed_at":"2026-08-07T14:17:06.234436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12356","last_updated":"2023-05-23T22:52:18Z","snapshot_observed_at":"2026-08-06T16:34:39.763163Z","submitted_at":"2022-09-26T01:04:52Z","title":"News Summarization and Evaluation in the Era of GPT-3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.12356","snapshot_observed_at":"2026-08-07T14:17:06.348017Z","title":"Goyal, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.348017Z"},"links":{"cited_paper":"/paper/2209.12356","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:988c4fbc7db9b42576db43180fa244d8159ff28593d5f612416c821b33c99728","observation_id":"efa20bac-cbbd-4daa-b68c-a808b9dacdd1","resolution":{"observed_at":"2026-08-07T14:17:06.348017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.640098Z","title":null,"venue":null,"work_id":"4627aead-e801-4d9a-addb-05404b6ad5be","year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.535420Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:68c3f60c03ed883cd81bdfb7868c9c2b8409711c3d091852b7e6168b9fc46b6c","observation_id":"dbf5fa6f-3ef9-4a6c-b1c6-91bc155f87b3","resolution":{"observed_at":"2026-08-07T14:17:18.714196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.415238Z","title":null,"venue":null,"work_id":"a3ac87ee-c76f-44db-b534-aa3c8b22b5fa","year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.727573Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:dc1e359917e5b8a77ccd28a69f6ee32593d0cd00f1d5bfdd8187d3b58b5132dd","observation_id":"741988c7-a835-495d-abb8-cd6fd1b571aa","resolution":{"observed_at":"2026-08-07T14:17:18.521830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.222364Z","title":"Kasai, K","venue":null,"work_id":"f5a0bede-0c68-4fea-90ca-dbc2773e1242","year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:06.935909Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:735cc7a971f667b9a69aaa54f058d5b28527c2678de6908a018f43acc94e82e0","observation_id":"eaf22fe0-51df-438c-a459-ccb239d95a0e","resolution":{"observed_at":"2026-08-07T14:17:18.301477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:18.033819Z","title":null,"venue":null,"work_id":"93a6d6bf-f090-4215-b1ae-7952fb5774e2","year":2025},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:07.157505Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:69159c459dc452219fc8a11ce7fe2f717616eb78c09616736336edffaa56c9f7","observation_id":"fe0acd55-0d63-4dea-ba47-0f1b57e2bb77","resolution":{"observed_at":"2026-08-07T14:17:18.107248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:17.870741Z","title":null,"venue":null,"work_id":"700d87a1-c674-498c-b192-61ccd8ed2d63","year":2017},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:07.369202Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:070cb990f4a2c6d8184b7dc7b80a664599804c4defc178144c73d6d7251f009d","observation_id":"a7c42aab-ee54-48df-ac78-e76487bc6dd9","resolution":{"observed_at":"2026-08-07T14:17:17.946874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T14:17:07.518573Z","title":"Lightman, V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:07.518573Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:9c26ad7b028317837af7f4bb786a97a14d203c86869c6bff6519d668787c3d40","observation_id":"f6e8f299-bf1b-4962-9419-82b1742ff0bd","resolution":{"observed_at":"2026-08-07T14:17:07.518573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T14:17:07.742384Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:07.742384Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:2f2af1747404169c348a08d06b37c83091718757f3fdfc5987c9bb28eebbc78a","observation_id":"0cd80e56-d6f6-46f6-995b-fa065e288c27","resolution":{"observed_at":"2026-08-07T14:17:07.742384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15532","last_updated":"2024-04-23T21:37:22Z","snapshot_observed_at":"2026-07-06T18:04:42.102581Z","submitted_at":"2024-04-23T21:37:22Z","title":"BattleAgent: Multi-modal Dynamic Emulation on Historical Battles to Complement Historical Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15532","snapshot_observed_at":"2026-08-07T14:17:07.899152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:07.899152Z"},"links":{"cited_paper":"/paper/2404.15532","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:ad0107b441ef4c01132fee33b04de47ca6b2690d286724a23ba53743d2d1cffe","observation_id":"2f670eaf-dacc-4946-900e-8cbb76fdb9a1","resolution":{"observed_at":"2026-08-07T14:17:07.899152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:17.681136Z","title":"Liska, T","venue":null,"work_id":"49f9f070-6b7f-404b-9478-5d7ee7438d44","year":2022},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.102824Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:f6b710553ef40b48571e9b58c835c841d554190b612bc25dc8a08543f068672e","observation_id":"6d40f1eb-aec1-40db-a74d-0af9a0248af8","resolution":{"observed_at":"2026-08-07T14:17:17.798553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20516","last_updated":"2024-07-30T03:26:09Z","snapshot_observed_at":"2026-08-05T09:03:38.463006Z","submitted_at":"2024-07-30T03:26:09Z","title":"Machine Unlearning in Generative AI: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20516","snapshot_observed_at":"2026-08-07T14:17:08.242684Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.242684Z"},"links":{"cited_paper":"/paper/2407.20516","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:bfc3985443e9501b5d728632f3fe05d45a477dc04770b133d1f8bc2ba5ff1eb1","observation_id":"f7d804a3-db95-4ddf-bb70-b269f9d90cd6","resolution":{"observed_at":"2026-08-07T14:17:08.242684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:17.503112Z","title":null,"venue":null,"work_id":"0d51bc8c-ddbe-474a-a027-e95be160da7d","year":2022},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.403171Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:8499e55af2f50e5aa9e220e85fe3e9d2b4e95b425d866217d2a914a4020f927e","observation_id":"35801905-0eae-45e0-b6db-0c864bb79626","resolution":{"observed_at":"2026-08-07T14:17:17.577875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10511","last_updated":"2023-07-02T07:21:59Z","snapshot_observed_at":"2026-07-06T14:33:08.041820Z","submitted_at":"2022-12-20T18:30:15Z","title":"When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric Memories","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10511","snapshot_observed_at":"2026-08-07T14:17:08.509373Z","title":"Mallen, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.509373Z"},"links":{"cited_paper":"/paper/2212.10511","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c538fc4093c5ab7bc84e54d0023ceda2e5e543aa0752e33eebc0676eae051605","observation_id":"51df139f-fd3e-4472-8c28-ec19bd340ae1","resolution":{"observed_at":"2026-08-07T14:17:08.509373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:17.344822Z","title":"Marketbeat: Stock market news and research tools","venue":null,"work_id":"fd55aa07-4444-4cbc-aa37-a59b945d1089","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.729003Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:6d2676b81fc9b8a4dec022f2218f15458efc3cc07dd67305ebaf9a60c6320e96","observation_id":"94f09798-5f5a-4623-8979-fe6f08845afa","resolution":{"observed_at":"2026-08-07T14:17:17.427476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14251","last_updated":"2023-10-11T05:27:50Z","snapshot_observed_at":"2026-08-01T16:29:58.693560Z","submitted_at":"2023-05-23T17:06:00Z","title":"FActScore: Fine-grained Atomic Evaluation of Factual Precision in Long Form Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14251","snapshot_observed_at":"2026-08-07T14:17:09.037776Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.037776Z"},"links":{"cited_paper":"/paper/2305.14251","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c8084be1bf793b6b430ed8a5dd24d03e6b89f11586ff20fdeba759f9f1ac066a","observation_id":"fbb82a40-6272-46e2-b84d-f2f919b104c4","resolution":{"observed_at":"2026-08-07T14:17:09.037776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07579","last_updated":"2024-06-06T06:31:08Z","snapshot_observed_at":"2026-07-06T16:31:16.784700Z","submitted_at":"2023-10-11T15:19:31Z","title":"In-Context Unlearning: Language Models as Few Shot Unlearners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07579","snapshot_observed_at":"2026-08-07T14:17:09.130469Z","title":"Pawelczyk, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.130469Z"},"links":{"cited_paper":"/paper/2310.07579","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:fd4ad39a70481c3111ceb2beb07ec4652f07f53ff74608a8ce4c6cf8a2fc74a5","observation_id":"2f2a4874-76f8-4a5a-bf4a-354e9a713de6","resolution":{"observed_at":"2026-08-07T14:17:09.130469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01066","last_updated":"2019-09-04T09:33:20Z","snapshot_observed_at":"2026-07-06T08:18:37.267833Z","submitted_at":"2019-09-03T11:11:08Z","title":"Language Models as Knowledge Bases?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01066","snapshot_observed_at":"2026-08-07T14:17:09.255739Z","title":"Petroni, T","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.255739Z"},"links":{"cited_paper":"/paper/1909.01066","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c502505c6475f19579ba18ec1475e8dcc85e5be7573d1963dda1821dc080d79a","observation_id":"8aa9a491-d5f7-4dec-b16b-cb8407077792","resolution":{"observed_at":"2026-08-07T14:17:09.255739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01267","last_updated":"2024-07-24T17:13:55Z","snapshot_observed_at":"2026-08-08T00:49:26.550027Z","submitted_at":"2024-03-02T17:10:44Z","title":"Dissecting Language Models: Machine Unlearning via Selective Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01267","snapshot_observed_at":"2026-08-07T14:17:09.398069Z","title":"Pochinkov and N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.398069Z"},"links":{"cited_paper":"/paper/2403.01267","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c4079d35e8a6791097a616a42c8450d9dd4f32ca2d67bdaf1b555cd5528c68e5","observation_id":"fccd8e0b-f8b7-475a-81d1-f76bcd3aa699","resolution":{"observed_at":"2026-08-07T14:17:09.398069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:09.561832Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.561832Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:60fd1cd731e8d40386ae7f52faccb3d4302cbe80739a56aec84ace70b35dc68d","observation_id":"bd429279-73f7-40e4-9682-a6424c9abb07","resolution":{"observed_at":"2026-08-07T14:17:09.561832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09072","last_updated":"2024-06-13T12:56:21Z","snapshot_observed_at":"2026-07-06T18:30:15.196556Z","submitted_at":"2024-06-13T12:56:21Z","title":"Living in the Moment: Can Large Language Models Grasp Co-Temporal Reasoning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09072","snapshot_observed_at":"2026-08-07T14:17:09.701397Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.701397Z"},"links":{"cited_paper":"/paper/2406.09072","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:9b8359d256bd0361ee664f5bc24375cadbb3925a5ec9cd6099287b34fe774b9e","observation_id":"2fe99ceb-b0cf-4e04-9920-69ad1d41de77","resolution":{"observed_at":"2026-08-07T14:17:09.701397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:09.821418Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.821418Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:5f108853c628e4ea84289d5796b79dc7110c4a03ad4c29134413c20099446de9","observation_id":"d317c146-9007-41cb-a1f2-7fe899e3aa8d","resolution":{"observed_at":"2026-08-07T14:17:09.821418Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08952","last_updated":"2023-06-27T05:39:25Z","snapshot_observed_at":"2026-07-06T15:42:52.549767Z","submitted_at":"2023-06-15T08:44:41Z","title":"Towards Benchmarking and Improving the Temporal Reasoning Capability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08952","snapshot_observed_at":"2026-08-07T14:17:09.966209Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:09.966209Z"},"links":{"cited_paper":"/paper/2306.08952","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:ae6b9a5c98c441ee2bb70874679a6bbc1790cc777958d510d6e7b07c3c99b3bc","observation_id":"c5f5e0c8-c4f8-4afa-aa57-d465439c2fc3","resolution":{"observed_at":"2026-08-07T14:17:09.966209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05355","last_updated":"2018-12-18T10:58:20Z","snapshot_observed_at":"2026-07-06T06:28:16.475418Z","submitted_at":"2018-03-14T15:30:37Z","title":"FEVER: a large-scale dataset for Fact Extraction and VERification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05355","snapshot_observed_at":"2026-08-07T14:17:10.073679Z","title":"Thorne, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.073679Z"},"links":{"cited_paper":"/paper/1803.05355","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c4d3ec6a1bedcc215d4582888c5a737f3d9cdcbd3b9d8bb2e5b83a411cbff652","observation_id":"d9111ad2-7a47-4125-82f4-861557e790ef","resolution":{"observed_at":"2026-08-07T14:17:10.073679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-07T14:17:10.208514Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.208514Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:5147d4402410876d1950b6463ca12625e8e486d73417764558155ec27beff8d3","observation_id":"3f2d16a7-1699-437b-b38c-dafcb4c771a3","resolution":{"observed_at":"2026-08-07T14:17:10.208514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14259","last_updated":"2024-06-03T21:15:28Z","snapshot_observed_at":"2026-07-06T15:31:41.985646Z","submitted_at":"2023-05-23T17:12:08Z","title":"SciMON: Scientific Inspiration Machines Optimized for Novelty","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14259","snapshot_observed_at":"2026-08-07T14:17:10.371409Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.371409Z"},"links":{"cited_paper":"/paper/2305.14259","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:d33c1032e100b9cde4b973c9bef2a3432e8dc63ef13f835b9657f84707401418","observation_id":"a7b859c6-a8b7-453d-a115-c2403e7f7ec8","resolution":{"observed_at":"2026-08-07T14:17:10.371409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23166","last_updated":"2025-02-17T08:59:45Z","snapshot_observed_at":"2026-08-08T00:00:08.825747Z","submitted_at":"2024-10-30T16:18:22Z","title":"SciPIP: An LLM-based Scientific Paper Idea Proposer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23166","snapshot_observed_at":"2026-08-07T14:17:10.495775Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.495775Z"},"links":{"cited_paper":"/paper/2410.23166","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:0e93f2c49d753aa4318f903738ad8afcd2f80d4db6dab2c443bf49a9aeff712b","observation_id":"a28019e9-e4f7-494f-b4c9-12e8eb11c259","resolution":{"observed_at":"2026-08-07T14:17:10.495775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:10.662705Z","title":"Wang and Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.662705Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:a4c22b27f1fa125fb840c42043e86f191aa44840ab14b9318aa57395d5a95b73","observation_id":"a39ee24c-e880-485e-8013-5c458c5f1949","resolution":{"observed_at":"2026-08-07T14:17:10.662705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:17.141477Z","title":null,"venue":null,"work_id":"ad8ae336-e17a-4439-ab9d-e63af0deacc5","year":2022},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.798603Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:9f0683d40e7b3210a0264644abca8add014b1de548b289f54dc808be89be9394","observation_id":"71741e14-ac93-4152-953d-1fe0dbc1247b","resolution":{"observed_at":"2026-08-07T14:17:17.262361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06853","last_updated":"2024-10-08T15:55:37Z","snapshot_observed_at":"2026-07-06T17:14:57.853205Z","submitted_at":"2024-01-12T19:00:26Z","title":"Large Language Models Can Learn Temporal Reasoning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06853","snapshot_observed_at":"2026-08-07T14:17:10.893153Z","title":"Xiong, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:10.893153Z"},"links":{"cited_paper":"/paper/2401.06853","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:5d96897e95ccb109d6ea32cb69a42b6f65a9ef366ff4cc8651db5d02f7ba84a1","observation_id":"830c7ce7-0a94-43a1-b4dd-198b85c0f1ff","resolution":{"observed_at":"2026-08-07T14:17:10.893153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.915873Z","title":null,"venue":null,"work_id":"4d9a3a5c-4a5b-4511-9224-b22024b8a6b6","year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.028799Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:9118f9ce23248f0fb89666500715bb3748eea618c6681cac228e155ab3d058e4","observation_id":"cbb57257-b9b7-4398-a980-92f592fcf8e2","resolution":{"observed_at":"2026-08-07T14:17:17.039292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16164","last_updated":"2024-04-24T19:40:01Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T19:40:01Z","title":"Towards a Holistic Evaluation of LLMs on Factual Knowledge Recall","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16164","snapshot_observed_at":"2026-08-07T14:17:11.194574Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.194574Z"},"links":{"cited_paper":"/paper/2404.16164","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:623b6e584a90bc2a29021b10cb86c32bfc3019d4730ab4c30350147225378a55","observation_id":"e6644fb1-8e98-4ef2-a06e-cb6ce8612f68","resolution":{"observed_at":"2026-08-07T14:17:11.194574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03818","last_updated":"2025-04-24T21:12:33Z","snapshot_observed_at":"2026-08-05T22:31:36.261531Z","submitted_at":"2024-04-04T21:57:11Z","title":"PRobELM: Plausibility Ranking Evaluation for Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03818","snapshot_observed_at":"2026-08-07T14:17:11.291923Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.291923Z"},"links":{"cited_paper":"/paper/2404.03818","citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:af5f74ad0e3d1f913c8cf5740edc3e86bad40557ab259fe7dc53a7a3758a6005","observation_id":"4a2a1b9a-503e-494c-8b88-5687053cc0cc","resolution":{"observed_at":"2026-08-07T14:17:11.291923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.715687Z","title":"Zhang, F","venue":null,"work_id":"516c1686-19e9-40ab-972d-1596889d423c","year":2024},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.404796Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:8b30456a9bfa0f1933887f6c73c1c4b6ad13d2fbc2782a3f6be6f6d915cd4479","observation_id":"0aa0d481-a503-4147-a676-b8f56e91d2a6","resolution":{"observed_at":"2026-08-07T14:17:16.811102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.564052Z","title":"+ Event +","venue":null,"work_id":"025fc322-1b53-4078-9240-ce4793e49d05","year":2023},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.453866Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:3817a14f6f16652a29a55db382fa349f7159b9d2b2575b5d218fed2c6b35254a","observation_id":"37d22026-afc1-4cb3-80e8-eaede780adb9","resolution":{"observed_at":"2026-08-07T14:17:16.638684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.413090Z","title":"+ Event +","venue":null,"work_id":"027128ff-3997-4256-b7a6-9ccc0cbb2416","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.457465Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:0515f61797c3afbbf9614441409d693809fabbc38d5485011d5bbf54f4cba945","observation_id":"92e7c5fe-7034-4ad8-97a8-bb410cd24ff1","resolution":{"observed_at":"2026-08-07T14:17:16.482764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.274876Z","title":"Otherwise, you ONLY return ’No leakage’","venue":null,"work_id":"93cd041e-af32-48b8-8568-883e3344de96","year":1946},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.460310Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:583d0bd495227075398b61dde6200caf798bb0a968d6432b2ee3d7f82c9ecc7e","observation_id":"a6fca7c5-5874-4af3-8d6c-d851da961c20","resolution":{"observed_at":"2026-08-07T14:17:16.351111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:16.081492Z","title":"Each fact should be a short, clear statement representing a distinct piece of information","venue":null,"work_id":"a09582eb-ef6a-4e11-9e8c-6d7b4feaca34","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.468918Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:51888ff46e3c115b58fba20977301ff7b06b4385bec5fd796cc2a3f935778823","observation_id":"1c9ce432-a17a-434b-8bff-ff0e108e7c46","resolution":{"observed_at":"2026-08-07T14:17:16.176959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:15.925449Z","title":"title\":","venue":null,"work_id":"d4d8cf7e-7290-402e-a154-9bd641556f18","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.492836Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:07e3ca3c9956ae032961880bd7335e43587004a96ce4c672627ef9059a14b379","observation_id":"63fc1673-9569-4a37-bf18-a97529864ace","resolution":{"observed_at":"2026-08-07T14:17:15.991543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:15.737856Z","title":"title\":","venue":null,"work_id":"88be9908-b78b-40f9-81b6-9bb46d4828d0","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.521924Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:479bed8751d6388f210046f6f764ca11b477e6bbeaed778dc0cbd514c0a5e3c6","observation_id":"0230eaed-d896-405c-8456-eec9828fa8fe","resolution":{"observed_at":"2026-08-07T14:17:15.828521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:15.552430Z","title":"What was the stock closing price of [Company Name] ([Ticker]) on [Event Date]? Please return a float number only. Example: ’143.16’","venue":null,"work_id":"f1ba9b9f-b57f-4678-8f3c-98565e41d610","year":2010},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.561933Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:8777c7e1fd35de42ea20e307058b20da66d47306bfcea0df49e3a6404cfdc676","observation_id":"e4e8ec72-010a-4bb0-b944-eba8596e94bd","resolution":{"observed_at":"2026-08-07T14:17:15.642356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:15.299313Z","title":null,"venue":null,"work_id":"6e29d1ce-3dd1-4906-925e-b5c94d78b224","year":2010},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.598220Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:320ce33fcdf3f7ff3ab4f10b68fb394d28521e8e5260199bfd4de8b0cdaa75a9","observation_id":"0f7e86ba-36a0-4b23-be1e-f597f8a1bf9c","resolution":{"observed_at":"2026-08-07T14:17:15.417324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:15.101334Z","title":null,"venue":null,"work_id":"9dfe9f33-9a45-4ad8-9970-975f75af6376","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.623233Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:4868502ea35b233c0a169b07f2b1b74e02cc2961472d20f87f77b9827220a5b7","observation_id":"2f46b880-eed3-4cf2-8152-622888bc0f00","resolution":{"observed_at":"2026-08-07T14:17:15.194172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.960967Z","title":"If you are at 2021-12-30, what is Apple’s stock price on 2022-12-30? Your answer should just be a num- ber, e.g., ’143.16’","venue":null,"work_id":"ae09e289-168f-40b2-ae5a-218cf3694f0a","year":2012},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.626631Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:ca3a6ab21a6f8e76b20512dd20523a2cba81cc8c0741bb0425b8bd1a3db73fcc","observation_id":"38b4b1c1-c405-41bb-9203-e23b037dc61c","resolution":{"observed_at":"2026-08-07T14:17:15.012756Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.833457Z","title":"• The abstract and/or introduction should clearly state the claims made, including the contributions made in the paper and important assumptions and limitations","venue":null,"work_id":"11f04f99-d8f3-4cd9-9323-8ecf9eaa0726","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.682954Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:764bdd6b61ae4114c11c597240e9791848d470792c229590c7fabdc74881c53e","observation_id":"c704b7fe-417a-4b15-9b05-db0f872f8d29","resolution":{"observed_at":"2026-08-07T14:17:14.889175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.693184Z","title":"Limitations","venue":null,"work_id":"2b83662a-8fa5-4fac-856b-93430157be73","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.707562Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:184171cf689c6a784ac327e0b137a939267e22a3bc4e85b4cfb703a9687809fa","observation_id":"b61987f1-1c11-44d3-9e66-a719e4e9c32f","resolution":{"observed_at":"2026-08-07T14:17:14.756213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.536485Z","title":"Guidelines: • The answer NA means that the paper does not include theoretical results","venue":null,"work_id":"d94dbd83-a30a-4ca7-be24-21ff0b285e2f","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.711737Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c91410b9690e31a53298d1549a9c9de29a53026433c211b78ec7e1a02b615cea","observation_id":"f28ffd75-008e-4053-846c-c145e6285c74","resolution":{"observed_at":"2026-08-07T14:17:14.603637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.430529Z","title":"Guidelines: 27 • The answer NA means that the paper does not include experiments","venue":null,"work_id":"a09e997f-ed40-4b98-b5f7-68810d07d9d1","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.761331Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:a3c74549657ce3e3aca45920f2b5e12d63da4210a7ee51cd8166cf9b33f623ac","observation_id":"56b1f4be-c9e7-486f-b9ea-c5f56cc0e383","resolution":{"observed_at":"2026-08-07T14:17:14.462730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.295442Z","title":"Guidelines: • The answer NA means that paper does not include experiments requiring code","venue":null,"work_id":"d2ebedd3-692d-4ddd-8d49-4e0c70a8be74","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.835778Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:434796d7ad705c2ed35adafd88e6fb40d270fb07be671aa96eec9b45fc98af45","observation_id":"cdb8626c-cd93-473b-a3d1-27d49ba52d56","resolution":{"observed_at":"2026-08-07T14:17:14.349620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.145806Z","title":"• The experimental setting should be presented in the core of the paper to a level of detail that is necessary to appreciate the results and make sense of them","venue":null,"work_id":"1d2b3d56-0cfa-4ae3-9c45-d16ddeb2badb","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:11.898742Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:59290fe662a5cb93524e0b393569a5b6176790d4a279db808f2abcdd5716e320","observation_id":"d322599f-5add-4274-a576-ad3406dc9e95","resolution":{"observed_at":"2026-08-07T14:17:14.217365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:14.048784Z","title":"Instead of reporting error bars, we tested each method on multiple datasets","venue":null,"work_id":"8236a271-7de7-4ad3-9156-e1c2961dcad1","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.004063Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:05941eae391048ee7147f4b50b3f9417d51f27e09d29ecbf710615d89a17d0b6","observation_id":"a672959a-f71d-4a03-8047-5ad75cd3078a","resolution":{"observed_at":"2026-08-07T14:17:14.084279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.926387Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"85a95597-ee7d-4604-80da-db90f3209154","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.135155Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:e02da435d4a257f11d2d393feab77ee0d0bc2714486574b373ef868243333f05","observation_id":"6213dab8-500d-4751-bfe7-32251137e12b","resolution":{"observed_at":"2026-08-07T14:17:13.982934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.782017Z","title":"Guidelines: • The answer NA means that the authors have not reviewed the NeurIPS Code of Ethics","venue":null,"work_id":"eb3a3766-520f-46c0-979d-d68690d1822e","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.219845Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:73f5915a00b4ef0305a77bbfdaf03639a0fb041e449e04bc8e528499c9c9098b","observation_id":"a29bf2c4-0202-45ba-bc73-6497e55cad2f","resolution":{"observed_at":"2026-08-07T14:17:13.852353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.653261Z","title":"Guidelines: • The answer NA means that there is no societal impact of the work performed","venue":null,"work_id":"b3d661a0-42b5-4c45-b27a-42d4076ec3c9","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.288068Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:4f45997f98e6ada7d0de3ce8d157a1173f18286e9740862965a797bf0bec224e","observation_id":"f7fc6a72-8ab3-4425-872f-cb8af0f6efbc","resolution":{"observed_at":"2026-08-07T14:17:13.710211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.524348Z","title":"30 Guidelines: • The answer NA means that the paper poses no such risks","venue":null,"work_id":"184e8683-5ff8-4c80-9f53-b5f770c343b0","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.327506Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:d017aed31383a9b535df0441790419e1dc684433f33d31dcfe13a1de5d0ebfd9","observation_id":"75740876-77c6-4d9f-b26c-64687bc8836c","resolution":{"observed_at":"2026-08-07T14:17:13.588037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.392724Z","title":"Guidelines: • The answer NA means that the paper does not use existing assets","venue":null,"work_id":"024d16e7-7c44-4e9d-8e32-672ee7d2a4cd","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.347001Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:a9cfcad572009d0ff87cd3c9b45b6ead63cb12b3113a7648b0b186af06ccf5b3","observation_id":"01b17fa3-36f0-4842-a611-913f47b26988","resolution":{"observed_at":"2026-08-07T14:17:13.444740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.233612Z","title":"Guidelines: • The answer NA means that the paper does not release new assets","venue":null,"work_id":"d9320280-ebe0-4eef-a0a2-be0f40b522a9","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.431903Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:be0ad40208e5502f6c79bcee605a2a09aabaae71cefe949434e06f99c831b44b","observation_id":"79aa03a8-0d25-41ec-81d7-c18fa33f0427","resolution":{"observed_at":"2026-08-07T14:17:13.316695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:13.090759Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"c88c112d-7f67-4d33-8b7a-b57831a23338","year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.497102Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:c6b5a449cdb3d7cc592ada39158e53b7ffed76e1fac6c6a498fe00f13b60c3e5","observation_id":"1fb41007-a946-4334-9455-daddd2d87bbc","resolution":{"observed_at":"2026-08-07T14:17:13.163549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:12.592691Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.592691Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:dc0f9674e5d1efe70c09f5bd552876c76e01d490c2dd2ae8d1b79473b6003083","observation_id":"857efd46-bd7d-4994-bfaf-5b1cbc22f6d5","resolution":{"observed_at":"2026-08-07T14:17:12.592691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:12.985969Z","title":"Answer: [Yes] Justification: We describe the usage of LLM","venue":null,"work_id":"f13555ab-b3b4-438b-b551-2a1e79ff7ca7","year":2025},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:12.652475Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:05b4b4087a5a3626f714fa6d76170fcb025924f7ce8eeb2142ef02ae0439772c","observation_id":"636c5391-03eb-4620-901e-62f14c4e3e78","resolution":{"observed_at":"2026-08-07T14:17:13.002091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:17:08.918288Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:17:08.918288Z"},"links":{"citing_paper":"/paper/2505.19533"},"observation_digest":"sha256:d00d53a9945e17f9f7012c3f5c5ed1f46c6a6c1a742e10a3bbfc0c17a71a1c3a","observation_id":"7d402c7e-f9b0-4246-879e-e5c3f325e6ac","resolution":{"observed_at":"2026-08-07T14:17:08.918288Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19533","last_updated":"2025-05-26T05:39:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T00:00:45.680749Z","submitted_at":"2025-05-26T05:39:57Z","title":"ExAnte: A Benchmark for Ex-Ante Inference in Large Language Models"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":41,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 1 inbound Pith citation observation for arXiv:2505.19533."}