{"as_of":"2026-08-11T08:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b3a53fee3fa0f7013831d1a948e95dbe8aabe4126d5a6d7b159a9a9063bb9f60","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:39:20.997542Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12980/citation-record","integrity":"/paper/2501.12980/integrity","json":"/paper/2501.12980/citation-record.json","paper":"/paper/2501.12980"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/17470218231157268","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.106326Z","title":"Oliver Bott, Matthias Schrumpf, Jens Michaelis, and Torgrim Solstad","venue":null,"work_id":"96d621c6-3e4b-40bf-86c7-07f70cee39a8","year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.814925Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:9950f3468381c532476cdc819e75e03995dfecc694f7c7af61dcbb6b84129211","observation_id":"bdefc3d3-b44e-4376-93c4-effaa8e122ed","resolution":{"observed_at":"2026-08-10T16:39:21.115968Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"unibi/2969323","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.088213Z","title":"To appear","venue":null,"work_id":"3b6c075c-3829-4c58-a9b3-70d515811456","year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.819897Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:1780b3b2bb0d0bf4f145276e306204a2ffe5c6f17d05c6b8b310581b864118ba","observation_id":"84f7aebf-3a31-45dd-9900-511d4186eee6","resolution":{"observed_at":"2026-08-10T16:39:22.095996Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01207","last_updated":"2021-06-02T14:52:11Z","snapshot_observed_at":"2026-08-03T13:17:14.175792Z","submitted_at":"2021-06-02T14:52:11Z","title":"Uncovering Constraint-Based Behavior in Neural Models via Targeted Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2106.01207","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01207","snapshot_observed_at":"2026-08-10T16:39:21.971915Z","title":"Uncovering Constraint-Based Behavior in Neural Models via Targeted Fine-Tuning","venue":"cs.CL","work_id":"19197c40-1a61-4e65-9ab0-0571a7599cf1","year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.830668Z"},"links":{"cited_paper":"/paper/2106.01207","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:ba5dfaa5909c9d153eb0b14cebe5cf441e585be13388ac4f06c6f0c7a50660c4","observation_id":"df458ec2-5bd3-47df-96d0-55767a73be00","resolution":{"observed_at":"2026-08-10T16:39:21.977018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.09757","last_updated":"2020-07-19T19:13:20Z","snapshot_observed_at":"2026-07-06T09:40:01.447392Z","submitted_at":"2020-07-19T19:13:20Z","title":"Mono vs Multilingual Transformer-based Models: a Comparison across Several Language Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.09757","snapshot_observed_at":"2026-08-10T16:39:20.841501Z","title":"Mono vs multilingual transformer-based mod- els: a comparison across several language tasks","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.841501Z"},"links":{"cited_paper":"/paper/2007.09757","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:76804a70b1679144ba4cf8cf9798a8acac3333c89efe620a6bfae82871c1a219","observation_id":"1e647545-8262-40af-98f7-f92768973e90","resolution":{"observed_at":"2026-08-10T16:39:20.841501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2020.10413","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.929377Z","title":"doi: 10.18653/v1/2023.findings-emnlp.868","venue":null,"work_id":"69e5ee61-1333-48d9-945e-cc9b94849ce2","year":2023},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.857278Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:424efd08a3d23433b0f93b323e841e4c64161ebbdb173810d7add8c615f4647a","observation_id":"344ee66b-6890-4071-9bf9-d4fae444caf7","resolution":{"observed_at":"2026-08-10T16:39:21.937252Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09751","last_updated":"2020-02-14T21:56:30Z","snapshot_observed_at":"2026-07-06T07:47:32.745963Z","submitted_at":"2019-04-22T07:17:18Z","title":"The Curious Case of Neural Text Degeneration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09751","snapshot_observed_at":"2026-08-10T16:39:20.876326Z","title":"The curious case of neural text degeneration","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.876326Z"},"links":{"cited_paper":"/paper/1904.09751","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:e0779293ffb3e9f1468b5901f1dce9c2852d32f496e0334d72f545dad59aba29","observation_id":"7127de50-eeb4-4f29-a942-91aaade09bd8","resolution":{"observed_at":"2026-08-10T16:39:20.876326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.885105Z","title":"doi: 10.18653/v1/2024.starsem-1.34","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.885105Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:6909dcf9bc1be6d880d1353528ba0c3c846ee1102f21a8fc1e348768bf7f0bfe","observation_id":"8cac11b9-1153-458f-9256-883028a8a2d6","resolution":{"observed_at":"2026-08-10T16:39:20.885105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01060","last_updated":"2021-06-02T10:26:07Z","snapshot_observed_at":"2026-07-06T11:15:10.443223Z","submitted_at":"2021-06-02T10:26:07Z","title":"John praised Mary because he? Implicit Causality Bias and Its Interaction with Explicit Cues in LMs","version":1},"cited_work":{"arxiv_id":"2106.01060","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01060","snapshot_observed_at":"2026-08-10T16:39:21.703473Z","title":"John praised Mary because he? Implicit Causality Bias and Its Interaction with Explicit Cues in LMs","venue":"cs.CL","work_id":"f0a8e47a-08ec-4e38-98dc-224d64fdfc09","year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.894832Z"},"links":{"cited_paper":"/paper/2106.01060","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:a7563d0b944d746145d64d9f5a1599d1fe3f4c3bc63bad3f8e2b313bd35af8f0","observation_id":"e27eaded-8653-4f30-ba7f-36794a0c5c92","resolution":{"observed_at":"2026-08-10T16:39:21.710003Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10668","last_updated":"2022-11-10T07:01:42Z","snapshot_observed_at":"2026-08-10T00:44:42.640325Z","submitted_at":"2021-12-20T16:52:35Z","title":"Few-shot Learning with Multilingual Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10668","snapshot_observed_at":"2026-08-10T16:39:20.909689Z","title":"Kyle Mahowald, Anna A Ivanova, Idan A Blank, Nancy Kanwisher, Joshua B Tenenbaum, and Evelina Fedorenko","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.909689Z"},"links":{"cited_paper":"/paper/2112.10668","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:7041b2c1594e07462b7c65851b4ab780fabe73d67f1c51e1aaeb684a36743aff","observation_id":"6c2979f7-eab2-4d68-8647-e8cd80a6cf25","resolution":{"observed_at":"2026-08-10T16:39:20.909689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07144","last_updated":"2024-08-13T18:26:04Z","snapshot_observed_at":"2026-08-10T01:01:14.890024Z","submitted_at":"2024-08-13T18:26:04Z","title":"Language Models as Models of Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07144","snapshot_observed_at":"2026-08-10T16:39:20.915210Z","title":"Praneeth Nemani, Yericherla Deepak Joel, Palla Vijay, and Farhana Ferdouzi Liza","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.915210Z"},"links":{"cited_paper":"/paper/2408.07144","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:dfdf0194b99ce015090891a7ce9cb62c8b6ce7c1143e30e7345efe5ce6f57992","observation_id":"54cfbd82-1e85-432b-87ce-122f3efeba6e","resolution":{"observed_at":"2026-08-10T16:39:20.915210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.nlp","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.631401Z","title":"doi: https://doi.org/10.1016/j.nlp","venue":null,"work_id":"b088e24b-1018-4516-aebc-59a0599ad3cd","year":2023},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.920083Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:7f3f693e224d8a2187e8562586133663923cbdd33e1fdcb305fe23de7d62110c","observation_id":"61938eff-d773-441e-9142-4f8065c19730","resolution":{"observed_at":"2026-08-10T16:39:21.636435Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06925","last_updated":"2024-10-08T07:46:47Z","snapshot_observed_at":"2026-08-09T06:57:17.341983Z","submitted_at":"2024-02-10T11:14:53Z","title":"A Thorough Examination of Decoding Methods in the Era of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06925","snapshot_observed_at":"2026-08-10T16:39:20.930564Z","title":"A thorough examination of decoding methods in the era of llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.930564Z"},"links":{"cited_paper":"/paper/2402.06925","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:2b46545bf2b7584db3a42614914e6fc998570c16777a9b11fc367653a6bbac10","observation_id":"b39cc43f-a87d-40bb-af75-27e5ebbbb513","resolution":{"observed_at":"2026-08-10T16:39:20.930564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07580","last_updated":"2023-10-12T17:07:29Z","snapshot_observed_at":"2026-08-10T13:14:58.826559Z","submitted_at":"2022-04-15T13:02:33Z","title":"mGPT: Few-Shot Learners Go Multilingual","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07580","snapshot_observed_at":"2026-08-10T16:39:20.935910Z","title":"org/abs/2204.07580","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.935910Z"},"links":{"cited_paper":"/paper/2204.07580","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:6ec613bebafd78fb06367485d221f7eedaa8482421b212663eb7b1aafb69c5a4","observation_id":"ded53c60-fcb5-4c15-a076-2a0c3413793d","resolution":{"observed_at":"2026-08-10T16:39:20.935910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.940830Z","title":"Torgrim Solstad and Oliver Bott","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.940830Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:876e1cc61fd5fead19663ff68de069574348bb07cb38e991f52a4158e22fdd6c","observation_id":"8545ca0d-8e35-4d4d-9031-890993b1554d","resolution":{"observed_at":"2026-08-10T16:39:20.940830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-10T16:39:20.945427Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.945427Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:84fe0cea5464cb9e190d8428c2ea604b1224268929c2fdbd3eadc57de5e7ec47","observation_id":"747aad37-2777-404c-8cbe-21ed100f13a6","resolution":{"observed_at":"2026-08-10T16:39:20.945427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.950770Z","title":"doi: 10.18653/v1/P19-1164","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.950770Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:22ef2c4868e55f94329ad49c739e807a707f9e0e9dfcbbe21497dd857db36c0f","observation_id":"bd9d3cf3-c911-4ca1-84d7-2050a9879f87","resolution":{"observed_at":"2026-08-10T16:39:20.950770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.181467Z","title":null,"venue":null,"work_id":"928051a1-3952-4536-a14b-d575117958b2","year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.955396Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:9cb7c0e899fed78acd78b5a17482fbeae3637c74a89df59c464414c4beba3a77","observation_id":"a2600b93-1576-4f3c-aefb-17fd237e13b6","resolution":{"observed_at":"2026-08-10T16:39:22.186867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02424","last_updated":"2018-10-22T13:48:32Z","snapshot_observed_at":"2026-07-06T05:13:49.420787Z","submitted_at":"2016-10-07T20:56:47Z","title":"Diverse Beam Search: Decoding Diverse Solutions from Neural Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02424","snapshot_observed_at":"2026-08-10T16:39:20.964602Z","title":"Diverse beam search: Decoding diverse solutions from neural se- quence models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.964602Z"},"links":{"cited_paper":"/paper/1610.02424","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:936142ec6c21e171443e35f5f632f030efc3c074760a9b44d9a9b00df50fb27e","observation_id":"4ede366b-4ace-4c11-9e7b-2e1e47dc696e","resolution":{"observed_at":"2026-08-10T16:39:20.964602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.974005Z","title":"doi: 10.18653/v1/2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.974005Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:aeb80c1715146f3779ae66e9634b0054e12e184aaaf781e812a1c070ef48e205","observation_id":"adddd6be-bf94-4888-a973-6e1ea6f15cab","resolution":{"observed_at":"2026-08-10T16:39:20.974005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.978179Z","title":"doi: https: //doi.org/10.1016/j.cognition.2021.104759","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.978179Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:bf0660e9893e97b282bd8b8c09e27fe3fd94b468077620458e6f9492bedd02d7","observation_id":"535577ab-8ff4-4e31-ab3b-51eac3d8bec7","resolution":{"observed_at":"2026-08-10T16:39:20.978179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15113","last_updated":"2023-10-26T11:45:28Z","snapshot_observed_at":"2026-07-06T16:37:19.963994Z","submitted_at":"2023-10-23T17:21:03Z","title":"Counting the Bugs in ChatGPT's Wugs: A Multilingual Investigation into the Morphological Capabilities of a Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15113","snapshot_observed_at":"2026-08-10T16:39:20.982942Z","title":"Zhaofeng Wu, Linlu Qiu, Alexis Ross, Ekin Aky ¨urek, Boyuan Chen, Bailin Wang, Najoung Kim, Jacob Andreas, and Yoon Kim","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.982942Z"},"links":{"cited_paper":"/paper/2310.15113","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:8052f9101adba56b6cade1d5e3524437572159bb5946c7319656d04e43c692f5","observation_id":"cf24acc0-9070-4db6-9562-bbaab73a114b","resolution":{"observed_at":"2026-08-10T16:39:20.982942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02015","last_updated":"2023-03-16T09:28:15Z","snapshot_observed_at":"2026-08-04T17:38:55.806742Z","submitted_at":"2023-03-16T09:28:15Z","title":"How well do Large Language Models perform in Arithmetic tasks?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02015","snapshot_observed_at":"2026-08-10T16:39:20.988290Z","title":"How well do large language models perform in arithmetic tasks? arXiv preprint arXiv:2304.02015,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.988290Z"},"links":{"cited_paper":"/paper/2304.02015","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:0589f4fad229e879558742e2e30b77b70fdb8b917c9ee578ff994c28e123aa8d","observation_id":"40dac65c-bc31-42ad-9c8f-b0632fef3833","resolution":{"observed_at":"2026-08-10T16:39:20.988290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.129929Z","title":"This isn’t the bias you’re looking for: Implicit causality, names and gender in german language models","venue":null,"work_id":"fdd4ec1f-7cba-4fd4-92b9-5f2e477c1aec","year":2022},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.992884Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:7db9c270ea38b2d74548cce52ea3bbf13bd694f3bc092c4470965de467058776","observation_id":"2446880a-239e-457b-a526-2626d96ff987","resolution":{"observed_at":"2026-08-10T16:39:22.135108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.00857","last_updated":"2022-12-01T20:24:19Z","snapshot_observed_at":"2026-08-11T00:47:09.099885Z","submitted_at":"2022-12-01T20:24:19Z","title":"a survey on GPT-3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.00857","snapshot_observed_at":"2026-08-10T16:39:20.997542Z","title":"URL https://aclanthology.org/2021.acl-long.90","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.997542Z"},"links":{"cited_paper":"/paper/2212.00857","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:f4f9808150926bf27804990d565217f18e87673eeeb0f53ee1d610c71d7f408f","observation_id":"13584d47-890a-460c-b65e-bf12de8bf727","resolution":{"observed_at":"2026-08-10T16:39:20.997542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/14640748008401161","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.091693Z","title":"Ronen Eldan and Yuanzhi Li","venue":null,"work_id":"6b3f06dd-4a67-4548-aa2e-fb7b850c1c54","year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":1980,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.836083Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:ffe013722700396979895db1bd5f37bc18a185b4cb8d5307602af6e29b633f34","observation_id":"31ca8c5f-1e59-46ae-a025-207bb052ed38","resolution":{"observed_at":"2026-08-10T16:39:21.096235Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.162017Z","title":null,"venue":null,"work_id":"cce8ff63-955d-4b7c-ab57-e933e1cb03e9","year":2020},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":1990,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.960021Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:2aba1dbc8ff3b403f81c6244a76f01c2cd6302c7da67df00093eb1df4f8d65d6","observation_id":"c3c07044-8cba-44d2-8bf5-3d1b946be3a3","resolution":{"observed_at":"2026-08-10T16:39:22.168380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1075/hcp.8.04ari","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.126686Z","title":"URL http://dx.doi.org/10.1075/hcp.8.04ari","venue":null,"work_id":"a518081a-15e2-4598-8979-8d7f97e1cd0b","year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.799024Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:69a4fbaeddd82e4032362785e64f8292fa3581f5e35a3266eb5e14ecae821fa7","observation_id":"90defa58-28f6-4ff1-97bd-aba168790fa9","resolution":{"observed_at":"2026-08-10T16:39:21.132395Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04887","last_updated":"2020-10-10T03:14:00Z","snapshot_observed_at":"2026-08-11T05:55:09.042910Z","submitted_at":"2020-10-10T03:14:00Z","title":"Discourse structure interacts with reference but not syntax in neural language models","version":1},"cited_work":{"arxiv_id":"2010.04887","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.04887","snapshot_observed_at":"2026-08-10T16:39:21.994699Z","title":"Discourse structure interacts with reference but not syntax in neural language models","venue":"cs.CL","work_id":"7f685428-0c64-40c0-adfa-95712a3d0521","year":2020},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.825586Z"},"links":{"cited_paper":"/paper/2010.04887","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:ef67835dedf942b2e72b3cc2859f7bed444eeabb167e8311ca7aeecd2d0d9833","observation_id":"001dcc56-f219-4e0a-b259-46d77cd69a26","resolution":{"observed_at":"2026-08-10T16:39:22.000877Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.05287","last_updated":"2019-01-16T14:01:15Z","snapshot_observed_at":"2026-07-06T07:27:04.673328Z","submitted_at":"2019-01-16T14:01:15Z","title":"Assessing BERT's Syntactic Abilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.05287","snapshot_observed_at":"2026-08-10T16:39:20.867420Z","title":"Assessing bert’s syntactic abilities","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.867420Z"},"links":{"cited_paper":"/paper/1901.05287","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:ffe0f1e1f243e214e9bb860641345110aa674750f7fe50119bf28fdad823644c","observation_id":"90cfacb5-8636-49cc-9fb3-bcad7f61a721","resolution":{"observed_at":"2026-08-10T16:39:20.867420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.jml.2009.09.001","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.060644Z","title":"doi: 10.1016/j.jml.2009.09.001","venue":null,"work_id":"9cad88b0-2762-4e17-b0d6-317f196f5a4d","year":2009},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.851587Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:533219be27f176944fafa3e8a6645b0415bdf288e1e9b91c10fc8f68264c0fee","observation_id":"6c33a0c4-eb61-486d-a2f5-e15226865645","resolution":{"observed_at":"2026-08-10T16:39:21.066492Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3758/s13428-010-0023-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.077011Z","title":"doi: 10.3758/s13428-010-0023-2","venue":null,"work_id":"af4ee508-aeef-41bb-abbf-a3f3457df9b8","year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.846887Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:978872c36f34870e7455b93bc3b4db45ad20a7360c413fc46bb3b5eae3a64fdd","observation_id":"ffc47ccd-d645-4712-89de-830d02e3982d","resolution":{"observed_at":"2026-08-10T16:39:21.081590Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.213076Z","title":"Implicitness of discourse relations","venue":null,"work_id":"fd8e9246-bfca-4f62-9cc5-368656fcdbc1","year":2012},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.803938Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:57e32e28d3f68ede3a7865c0689c6e7c9dee8d01e43cf662e9846ba3abfebff5","observation_id":"7c121876-6e4a-46ea-8a2d-ef20fe867b9c","resolution":{"observed_at":"2026-08-10T16:39:22.219617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:20.871981Z","title":"Robert D","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.871981Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:d44ec422f832e94823656869eadb7afb8320903e5809018100e8247ab8139e4e","observation_id":"f836e792-4628-41d0-ab10-7ea8a129c646","resolution":{"observed_at":"2026-08-10T16:39:20.871981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.146064Z","title":null,"venue":null,"work_id":"1d5dd5f4-877e-4032-8c4b-2401ebd6e7e7","year":2020},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.969227Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:4c7cae00c1ff8401ca75cf1bdc199d5688ceb637edc6781bfc1fd78e4f6325ec","observation_id":"d4f99604-b139-4d7c-8f66-012e8909a08c","resolution":{"observed_at":"2026-08-10T16:39:22.151194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-08-06T19:23:30.079167Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-08-10T16:39:20.889791Z","title":"Towards reasoning in large language models: A survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.889791Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:7d90ea9e644fdf680af4b9586dc1dac2d08a08fa14902bb1b569968023404b1b","observation_id":"5a90f6b8-2cfe-4b9c-8229-50d2810b1aa2","resolution":{"observed_at":"2026-08-10T16:39:20.889791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:22.197729Z","title":null,"venue":null,"work_id":"bf6cd078-b5e4-4192-adce-354e6ff7767d","year":2024},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.881044Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:3a86cdfb750a6208a9b5bf92802d4752310fa17c3ac579682adcc52ff256b9aa","observation_id":"3f09c501-65bc-48f5-877d-dd244b5aade5","resolution":{"observed_at":"2026-08-10T16:39:22.202588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.coling-main.107","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:39:21.145165Z","title":"doi: 10.18653/v1/2020.coling-main.107","venue":null,"work_id":"3248fe9c-fc98-45fe-bb28-c965afcac6db","year":2020},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.793416Z"},"links":{"citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:360f3064361318c5206e830641cb32c3e4ea19c0e427fda506df98109b23e426","observation_id":"25c264a6-0a52-47d5-9a53-d7a9bf002cc8","resolution":{"observed_at":"2026-08-10T16:39:21.149982Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14337","last_updated":"2021-04-07T17:49:17Z","snapshot_observed_at":"2026-08-03T23:24:34.241550Z","submitted_at":"2021-04-07T17:49:17Z","title":"Dynabench: Rethinking Benchmarking in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14337","snapshot_observed_at":"2026-08-10T16:39:20.900119Z","title":"Dynabench: Rethinking bench- marking in nlp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.900119Z"},"links":{"cited_paper":"/paper/2104.14337","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:4366940e798c62bb4f0c79f97a3799eb9e2e5bb745cb66b35ccaf33e6a1373df","observation_id":"3bfebf8d-203d-47db-bea3-2d1bb1b32492","resolution":{"observed_at":"2026-08-10T16:39:20.900119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.12393","last_updated":"2021-09-25T16:02:23Z","snapshot_observed_at":"2026-08-08T12:14:05.538905Z","submitted_at":"2021-09-25T16:02:23Z","title":"Sorting through the noise: Testing robustness of information processing in pre-trained language models","version":1},"cited_work":{"arxiv_id":"2109.12393","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.12393","snapshot_observed_at":"2026-08-10T16:39:21.551192Z","title":"Sorting through the noise: Testing robustness of information processing in pre-trained language models","venue":"cs.CL","work_id":"8e8c3c00-911d-4f32-a52f-e2ff99643402","year":2021},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.925298Z"},"links":{"cited_paper":"/paper/2109.12393","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:ae6984ec3cef1b513a93b60bf6965c69394cbac3cde4a6a914d2484b88c0ce86","observation_id":"62b4d333-0724-45c4-a67d-6c458afe038f","resolution":{"observed_at":"2026-08-10T16:39:21.557223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04218","last_updated":"2018-05-11T01:34:52Z","snapshot_observed_at":"2026-07-06T06:38:31.662914Z","submitted_at":"2018-05-11T01:34:52Z","title":"Deep RNNs Encode Soft Hierarchical Syntax","version":1},"cited_work":{"arxiv_id":"1805.04218","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.04218","snapshot_observed_at":"2026-08-10T16:39:22.112068Z","title":"Deep RNNs Encode Soft Hierarchical Syntax","venue":"cs.CL","work_id":"4f7010df-9397-4be6-9a97-ea348aaa336c","year":2018},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.809422Z"},"links":{"cited_paper":"/paper/1805.04218","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:fdae828b8f04e1c93ece185c2e3aed0f95cb09752e98f44d6749fac12ba05df5","observation_id":"9ac71b95-8611-4a82-8356-295251289812","resolution":{"observed_at":"2026-08-10T16:39:22.118554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05653","last_updated":"2024-10-05T20:14:30Z","snapshot_observed_at":"2026-08-09T12:09:53.759700Z","submitted_at":"2024-09-09T14:19:21Z","title":"WinoPron: Revisiting English Winogender Schemas for Consistency, Coverage, and Grammatical Case","version":3},"cited_work":{"arxiv_id":"2409.05653","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05653","snapshot_observed_at":"2026-08-10T16:39:21.848478Z","title":"WinoPron: Revisiting English Winogender Schemas for Consistency, Coverage, and Grammatical Case","venue":"cs.CL","work_id":"214539bb-64a5-48e6-b5fb-8162fe801ea8","year":2024},"citing_paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T16:39:20.862518Z"},"links":{"cited_paper":"/paper/2409.05653","citing_paper":"/paper/2501.12980"},"observation_digest":"sha256:61a7ac55d9666be29df58cbe06336690d73e567eb117f728d3d04882437d6f33","observation_id":"d9a1476d-6394-44ce-b20a-6489955bcd70","resolution":{"observed_at":"2026-08-10T16:39:21.854376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.12980","last_updated":"2025-01-22T16:07:24Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T03:36:24.718292Z","submitted_at":"2025-01-22T16:07:24Z","title":"Implicit Causality-biases in humans and LLMs as a tool for benchmarking LLM discourse capabilities"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":24,"verified_exact":11,"verified_fuzzy":2},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2501.12980."}