{"as_of":"2026-08-08T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:831d22e08dbc997dde6635f1410826a117037a04a7e0b82e3945baa1171969f8","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:31.684757Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.17180/citation-record","integrity":"/paper/2506.17180/integrity","json":"/paper/2506.17180/citation-record.json","paper":"/paper/2506.17180"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.719426Z","title":"Assessment in science education: A study of teaching effectiveness","venue":null,"work_id":"2dc2f88b-2816-4030-aa09-604b57939177","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.638495Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:ce160bffc52762bb970d7b9631ea5b0f0419ef0a2db2bef7cdeb00926c35ead8","observation_id":"c955ac35-2da0-4220-bc05-89b0955cb2b4","resolution":{"observed_at":"2026-08-06T23:34:36.856619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.575435Z","title":"Cbse assessment framework for science, maths and social science classes 9 and 10, 2020","venue":null,"work_id":"43a21a4f-82d0-4da6-840c-dbb426c45d15","year":2020},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.847326Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:bf99e04ffe13e87a2be7ee76e1873f51d08c778348fcd549a07ea9d97a570811","observation_id":"6c8dde00-4a1f-49cc-b6f3-e5def3c6f121","resolution":{"observed_at":"2026-08-06T23:34:36.643752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.393481Z","title":"Bloom, Max D","venue":null,"work_id":"2c99e494-2757-4e03-8325-f0747a331753","year":1956},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:27.999453Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:810744168e6bdf3da1a54589ea21f8d0dd681e2f8302a84995db139e5814548c","observation_id":"f70a2faf-7ce5-4f9d-9d97-80effefa7046","resolution":{"observed_at":"2026-08-06T23:34:36.467416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.229104Z","title":"Anderson, David R","venue":null,"work_id":"539c9d1f-21d6-4c2d-9466-5944c4b62964","year":2001},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.216326Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:4985033f04aa9882db2441f10a5b8d4e7aa77d45479f5289aa946d75fdb7550a","observation_id":"cc3aac27-7414-47c1-af97-732c5a7629cf","resolution":{"observed_at":"2026-08-06T23:34:36.304831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.020532Z","title":"Malalgoqa: Pedagogical evaluation of counterfactual reasoning in large language models and implications for ai in education","venue":null,"work_id":"dc5cdeeb-cdf2-43f5-be5c-d06f6c24d11a","year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.287009Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:8499173803de92c6109760afd51e7011a497ecc445ff293b466bd6444fea812e","observation_id":"4e0c1e0d-557a-4186-b9a5-aec58b7c7245","resolution":{"observed_at":"2026-08-06T23:34:36.115224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:28.419985Z","title":"Thinking, Fast and Slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.419985Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:6b12546a6b1c3b0156ffff57170deccdf08029f2c4c95a83a0f71757d52f588a","observation_id":"5fa84c2e-fb64-4a47-ba99-f6ef48232ab1","resolution":{"observed_at":"2026-08-06T23:34:28.419985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.803551Z","title":"Dual-process theories of higher cognition: Advancing the debate","venue":null,"work_id":"03f18803-e67d-4469-a562-911dbf430be3","year":2013},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.635181Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:593f05352fd15c6f78d1451b089e58fcf6d95bd905a3d4fd589985d1930f9fdd","observation_id":"299d020f-5a79-4b5d-bbbf-7ddbf98535b0","resolution":{"observed_at":"2026-08-06T23:34:35.916792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.680154Z","title":"Bowman, Gabor Angeli, Christopher Potts, and Christopher D","venue":null,"work_id":"64390b1a-3ab5-469f-a894-0a56f8a8deda","year":2015},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.734129Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:ed3a99a3c9a8241cdafb9081f3b4f3f1bf19d75ad2c698994ccec2fb5955bc16","observation_id":"ebf56e91-d8d5-4222-b94a-f513544a5419","resolution":{"observed_at":"2026-08-06T23:34:35.740210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.540353Z","title":null,"venue":null,"work_id":"6c9b0075-809f-4dd2-a9fa-e778d003012d","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:28.877039Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:5c5bb37224cbd1fda67b1929a62cd3c1123ea2e118779777f9516d884eb63d2d","observation_id":"ddecb367-5cf1-4aaa-993a-984ad2228a55","resolution":{"observed_at":"2026-08-06T23:34:35.621043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.354132Z","title":"SQuAD: 100,000+ questions for machine comprehension of text","venue":null,"work_id":"99df018c-744f-40d3-b972-9bb334ec39fb","year":2016},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.049684Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e97ee9d7a0b53cc01a2b41e17e8757ffab1ba38b3ce7d1d8bdff38b205037a46","observation_id":"c2bccd31-ea7c-4933-9deb-3f9c479135be","resolution":{"observed_at":"2026-08-06T23:34:35.456528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.090314Z","title":"Hutchinson, and Richard G","venue":null,"work_id":"fe5f7928-3580-4b7e-853a-5483da1d6c76","year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.223595Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:f4dac31696ae0a0801be7fbb21829374812b86516c78ae04c857d9d18c55cb50","observation_id":"b4ec3bf0-a908-4e57-a880-2bf82157f0a2","resolution":{"observed_at":"2026-08-06T23:34:35.200748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.795807Z","title":"CommonsenseQA: A question answering challenge targeting commonsense knowledge","venue":null,"work_id":"b3c50d6b-7ad3-49b8-a98b-5281246f919d","year":2019},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.379705Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:84c5dcbc6012c63957994b8231094ea6d68650d06b0175b2e7bfdc1180a98975","observation_id":"77217a69-f736-4e16-8949-2b0be8431aa2","resolution":{"observed_at":"2026-08-06T23:34:34.960660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.568512Z","title":"WinoGrande: An adversarial Winograd schema challenge at scale","venue":null,"work_id":"630590ce-049a-4e39-a21e-9717e6825691","year":2020},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.555304Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:2ba77950e0c981b73fe383991eaf7f823e563537952f349a00d7871c71b61051","observation_id":"6c0ef4bf-850f-47b7-b6fc-291edba5b592","resolution":{"observed_at":"2026-08-06T23:34:34.641689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.381034Z","title":"FEVER: A large-scale dataset for fact extraction and verification","venue":null,"work_id":"219d532a-9105-4e26-b8be-93d6f71f83ed","year":2018},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.641483Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:6fcd3c931f25c0166b146022430f4944b80a2240caa579f2c7c7b5bb0f73ea25","observation_id":"c78751fa-86a9-4360-a5a7-7734acbf13ae","resolution":{"observed_at":"2026-08-06T23:34:34.476987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14974","last_updated":"2020-10-03T04:31:06Z","snapshot_observed_at":"2026-07-31T19:27:50.950253Z","submitted_at":"2020-04-30T17:22:57Z","title":"Fact or Fiction: Verifying Scientific Claims","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14974","snapshot_observed_at":"2026-08-06T23:34:29.816345Z","title":"Fact or fiction: Verifying scientific claims","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.816345Z"},"links":{"cited_paper":"/paper/2004.14974","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:81801b150c8653309c7f79015065237e8440d8ce9758fbf66531409caa1f0298","observation_id":"591bbfb5-3252-403c-af8e-d41d352e88e8","resolution":{"observed_at":"2026-08-06T23:34:29.816345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:34:29.937166Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:29.937166Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:2759ea753033c617fda49d6ae8eb2222b92a327821c33692a6bbaef41df04610","observation_id":"35b332ff-9fc1-4faa-aa6b-2531285d7808","resolution":{"observed_at":"2026-08-06T23:34:29.937166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T23:34:30.032234Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.032234Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:c32d0738e9e821cf9ee211b96efe8b584bd076a66500fa89772b651c217aef49","observation_id":"32d3aeae-e6f9-4c04-9e40-fdcf7673f323","resolution":{"observed_at":"2026-08-06T23:34:30.032234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T23:34:30.125545Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.125545Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:df92f670a0025589af0c8263405af6208bf69bc895bb85535fa789712a311184","observation_id":"f3837aa7-8513-464a-bf76-ca83285f287d","resolution":{"observed_at":"2026-08-06T23:34:30.125545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T23:34:30.266416Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.266416Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:248419ba213bdb795426b2a2038bd3794a86d9ac8f2e7d940b85c86ce75d93e9","observation_id":"96a14359-8ee3-4192-b5b0-ed03107b1a3a","resolution":{"observed_at":"2026-08-06T23:34:30.266416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T23:34:30.385458Z","title":"Phi-4 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.385458Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:a98a349fe5d40be7ab069d955f6e05c2b040a649849680fc4438599f7da1ee0c","observation_id":"ff585210-453b-490f-8e1d-f95af7e25606","resolution":{"observed_at":"2026-08-06T23:34:30.385458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.207451Z","title":"When one model casts doubt on another: A levels-of-analysis approach to causal discounting","venue":null,"work_id":"4b59d3e4-13ae-44b1-9691-525699f145b0","year":2011},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.554878Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:063c39bed4215c42acebdcf3866288ca95b2dcdbd4e665a4fa154c478f1ae145","observation_id":"6b1b6237-cd99-4231-83e4-e464c67bf3dd","resolution":{"observed_at":"2026-08-06T23:34:34.297459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.974121Z","title":"The most common error is incorrectly classifying option (b) as option (a) (176-214 instances across models)","venue":null,"work_id":"74be3df3-0fca-4247-859f-14f3cd4050a2","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.735614Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:0277028ffeb7a1be3dc8541a864dafdfdec7d992242f3280cfef5d74ab99e65b","observation_id":"055c84a6-a36c-421e-ae31-884271148fc2","resolution":{"observed_at":"2026-08-06T23:34:34.094387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.741462Z","title":"Even the largest model, Qwen3-32B, misclassifies option (b) as option (a) in 195 cases (27.1% of all true (b) cases)","venue":null,"work_id":"4fe37f86-50a4-433c-ad45-b3ad4d656f6c","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:30.887249Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:1f22f4b5281a93f9e5c0d7fc041c6cc45006663479ed2d749d714414cce5d382","observation_id":"871c92f1-1083-405e-a5ba-60a540d572f7","resolution":{"observed_at":"2026-08-06T23:34:33.847413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.537995Z","title":null,"venue":null,"work_id":"e6761b57-bad6-4923-a727-58361644f2db","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.013302Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:3f31391eed668c5cbba7886ac3d6a78d43f02cde44c326e8abd0df3bbcc55ac1","observation_id":"fe6cdd58-1579-48e2-95e8-1f11e5c126c6","resolution":{"observed_at":"2026-08-06T23:34:33.658462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.164703Z","title":"Model family differences suggest that some design and training strategies may better support causal reasoning, particularly in complex domains","venue":null,"work_id":"12120695-b27f-44c1-a7c5-ec61bbda644b","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.082574Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:91174b217b4d225da506f4846405266358f2dfc2fd2efc037b5714bea53549cb","observation_id":"4f8b2fdb-3e17-4b0c-99bd-2b73f6e7ca35","resolution":{"observed_at":"2026-08-06T23:34:33.339491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.923278Z","title":null,"venue":null,"work_id":"839f4c8c-1e7d-465a-814c-f7ba40398a20","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.206215Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:1f812665e5274fad9e3f2cdc383332f0780e05d2d7d1e9670fbb34c1d3471d0c","observation_id":"b4062b7d-825e-4ea3-841f-3f0893eead36","resolution":{"observed_at":"2026-08-06T23:34:33.017115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.732169Z","title":null,"venue":null,"work_id":"174264e3-b3db-483e-ae72-4f6a2c3475b3","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.284075Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:0d33980408c0030c4cd202f447fecd173ddf7d05de7f88d60b793d9dc6ec2940","observation_id":"47c042e4-5365-4b94-8326-4dc3c76dc8b1","resolution":{"observed_at":"2026-08-06T23:34:32.804755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.428000Z","title":"These t-tests determine whether the differences in similarity are statistically significant or could have occurred by chance","venue":null,"work_id":"021b5b96-78dd-4f97-b39a-cefae500a035","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.431743Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:7c0c8280f4c25815cb44ae9f5d05712d4b76edca82d3b9ea207538c5f8e1eeb5","observation_id":"d5df085c-b832-4137-8289-6784299fc9e8","resolution":{"observed_at":"2026-08-06T23:34:32.563860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.215578Z","title":"Yes\" versus all cases where it predicted","venue":null,"work_id":"0e1ec672-d249-4c30-be4a-f256a6a5a8f0","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.532676Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:e2fa63bd83197788bc4142411b0eb3aef09589082993402d6b22e2dc9460497e","observation_id":"58740287-4290-4ce3-8d25-b045a34a1198","resolution":{"observed_at":"2026-08-06T23:34:32.318389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.049941Z","title":null,"venue":null,"work_id":"4c1bd1e5-9253-4359-8889-e48266cb43a4","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.612422Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:1c24efd279de9705d603d21714dfa2a2ee21dae4ce876adc38c0d6200840f786","observation_id":"82369732-23bf-4c32-b2c9-944a32f473f5","resolution":{"observed_at":"2026-08-06T23:34:32.123936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.911026Z","title":"This pattern represents a fundamental confusion of correlation (semantic similarity) with causation (explanatory relationship)","venue":null,"work_id":"b7143725-f09e-48e7-8e93-7d1103059933","year":null},"citing_paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:34:31.684757Z"},"links":{"citing_paper":"/paper/2506.17180"},"observation_digest":"sha256:5e9b2a2759c683a4ac20d5dec6caa9d3d43e3444e68cdd890944165a217bff17","observation_id":"b7dd928c-1127-47ae-bb7d-6a017bf98679","resolution":{"observed_at":"2026-08-06T23:34:31.976303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17180","last_updated":"2025-06-20T17:35:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:28:34.714930Z","submitted_at":"2025-06-20T17:35:36Z","title":"CLEAR-3K: Assessing Causal Explanatory Capabilities in Language Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2506.17180."}