{"as_of":"2026-08-07T23:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70db403d085285e096f0457b20cdf26eb981e12bd2cd9ac045687c94344efa60","coverage":[{"denominator":129,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:46:43.806230Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.07064/citation-record","integrity":"/paper/2506.07064/integrity","json":"/paper/2506.07064/citation-record.json","paper":"/paper/2506.07064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.406581Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.406581Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3ac6149a00a54c70a0d815956e8b334cfecd8837cdd5fc259e9743320dacd892","observation_id":"a1fd4aae-386f-4b4f-8979-102f0ba8773b","resolution":{"observed_at":"2026-08-07T05:46:43.406581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.410216Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.410216Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a3ef861766a92d3e624c15ef816ff6e38cb53e55ff17f6df85f3561fae3c55c5","observation_id":"516286a4-6ef6-4c0e-9c7b-c7b3c1bad12d","resolution":{"observed_at":"2026-08-07T05:46:43.410216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.413647Z","title":"Here are the given event: {} You should follow the format like: {} -> EVENT -> EVENT -> EVENT -> EVENT Causal Chain Proposal: Intervention You are an expert in causality","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.413647Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2d5d0909450b8be3ab8da220e8d33860e988f371a5b4e7887f84aeed92fde40e","observation_id":"6b898d6f-0915-41ae-a4d2-5e7a50ba3f79","resolution":{"observed_at":"2026-08-07T05:46:43.413647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.428945Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.428945Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c5cd1044e143699e5d8f87a418b071e6b58116cc978ebd5d3e3647fb283c5858","observation_id":"8503fb2b-94d9-4d60-9532-2afa96a2dbd6","resolution":{"observed_at":"2026-08-07T05:46:43.428945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.432389Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.432389Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8a926bdca49bed6d70c72a84d9f363672912846e4e9d6f5f81995fc634151a8f","observation_id":"d7bcc5af-101b-486a-94a1-fb87fa3a8444","resolution":{"observed_at":"2026-08-07T05:46:43.432389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11694","last_updated":"2024-12-31T01:38:12Z","snapshot_observed_at":"2026-07-06T19:52:03.121993Z","submitted_at":"2024-11-18T16:15:17Z","title":"Enhancing LLM Reasoning with Reward-guided Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11694","snapshot_observed_at":"2026-08-07T05:46:43.398130Z","title":"Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yu- taka Matsuo, and Yusuke Iwasawa","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.398130Z"},"links":{"cited_paper":"/paper/2411.11694","citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:cdf784b36a722b8fe56c7f7475907af8a589aea676024c75cf37bd6dba4e1037","observation_id":"fa67507f-6f74-448c-a283-ebf292b38dd5","resolution":{"observed_at":"2026-08-07T05:46:43.398130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14405","last_updated":"2024-11-25T17:57:55Z","snapshot_observed_at":"2026-07-06T19:53:56.407834Z","submitted_at":"2024-11-21T18:37:33Z","title":"Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14405","snapshot_observed_at":"2026-08-07T05:46:43.402367Z","title":"Shunyu Yao, Jeffrey Zhao, Dian Yu, Nan Du, Izhak Shafran, Karthik R Narasimhan, and Yuan Cao","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.402367Z"},"links":{"cited_paper":"/paper/2411.14405","citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:0e64b526cf0bf6e7a9551754cbb4b4efeb7d08154f715bdef0a378c3ef8b7eb2","observation_id":"e937a46e-e25e-47c4-a93e-1d1bc5cdc030","resolution":{"observed_at":"2026-08-07T05:46:43.402367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.520625Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.520625Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:739c4b2a9d2a7fa93223d342e081f9ae7ef2d6d784e5d81aa03fc0a0f4bf6da0","observation_id":"79eb147e-d269-4bda-8ff8-763d13c72530","resolution":{"observed_at":"2026-08-07T05:46:43.520625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.523908Z","title":"Causal Graph Proposal and Com2 Synthesis: Intervention After understanding the causal chains, we need you to create a multiple-choice example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.523908Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:83f1ee57624ca902b62ced1ef74d68c547ec60b501476f0385868cfc49abfadb","observation_id":"a5c4821f-1298-4beb-a848-6396d25bed6c","resolution":{"observed_at":"2026-08-07T05:46:43.523908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.424945Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.424945Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e8d53b619b91aea945e5d598aac1ecab6cee427c4434f8ab05611fbb895b22e1","observation_id":"c8cd7060-9bbd-442d-b90e-f9ee4f25d803","resolution":{"observed_at":"2026-08-07T05:46:43.424945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.439181Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.439181Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:31a2a3475991880241a3a71075f3141b968399a27040dd1938437f4ba85b99ae","observation_id":"4c3d697d-688d-474a-842a-5742ed2aa752","resolution":{"observed_at":"2026-08-07T05:46:43.439181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.442566Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.442566Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:fa15d15bc1c8ce84cdb39f50818bd3d60c6b026d312ccf508c6be1de1a03650d","observation_id":"0371274c-8832-4968-a4d2-2e92d36ac422","resolution":{"observed_at":"2026-08-07T05:46:43.442566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.445994Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.445994Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9b6181bc9029855d11903935f40511f3ba63db287d37a6f4e8a06d5797b89943","observation_id":"54e3ac7e-4bd0-473d-8cd6-21106aa89155","resolution":{"observed_at":"2026-08-07T05:46:43.445994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.449375Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.449375Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7d2e61be7f8fac1548622f1ef76805ac4e086e38d70d0a949b50a7ed4d463c64","observation_id":"41a18d66-3816-4d19-a017-32bae8adfea4","resolution":{"observed_at":"2026-08-07T05:46:43.449375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.452743Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.452743Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:16f39a6ac3dbbcead0cc195e69c2f40e9aaefcc7377549f5f8280bdbdb706138","observation_id":"d3a35ce8-7609-4a90-8505-2286c86c78c4","resolution":{"observed_at":"2026-08-07T05:46:43.452743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.456184Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.456184Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2f792ec3b2ce3ef2737c94489ce1fdd4d8138b7b24b918c806e33c2a06ff3256","observation_id":"cc4c40da-bee1-452a-8500-6a372d46afa1","resolution":{"observed_at":"2026-08-07T05:46:43.456184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.459515Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.459515Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7936eba1acfb9d2b62a9a0588d021c133c3a8ae407cc2433ee435858dcf2ac15","observation_id":"f45ca0f9-a795-4360-822f-468be31ae0a2","resolution":{"observed_at":"2026-08-07T05:46:43.459515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.462780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.462780Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b3d2c7d152d147f7302d0e184f103de986d469edf889fd31f30d02978093d4c7","observation_id":"95d81aeb-5c0a-45cc-94fc-15a87b7229ab","resolution":{"observed_at":"2026-08-07T05:46:43.462780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.466115Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.466115Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a0d5ae25df2f6f0aafb1bc01b78333cf7af1c13d8f2956344fd4f0c73d28734d","observation_id":"07b3d645-1453-4bb9-bced-55a5b36af9f3","resolution":{"observed_at":"2026-08-07T05:46:43.466115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.469405Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.469405Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4acbb853c81afd4877375953b94d120e828a8e00861b01afa3cb507c5271bcda","observation_id":"28bd4ec9-e6d3-4623-9bb3-23824351758e","resolution":{"observed_at":"2026-08-07T05:46:43.469405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.472908Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.472908Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7e61263e205be820ab18221da583e6e6fbc1abedcf43351e20b0d6cf8620b4b9","observation_id":"031e02c8-d040-45d1-9802-08b244f7f5da","resolution":{"observed_at":"2026-08-07T05:46:43.472908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.476215Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.476215Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:31c46bdcd300b4a7c9c69ac0094b095268e765ad08f0d6561a8c27886786f521","observation_id":"c86dd821-8428-48e0-8f31-7669deb20847","resolution":{"observed_at":"2026-08-07T05:46:43.476215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.479383Z","title":"Take a causal chian A -> B -> C for example, here are the reference of the reason for the causal transitive problem:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.479383Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c835dd4513a5d4057c606f9ea47ad7d8bfc37297f865145ceab1bc7b9781bb5f","observation_id":"02f2b986-4683-4122-aabb-ac488a245fea","resolution":{"observed_at":"2026-08-07T05:46:43.479383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.483133Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.483133Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:75243965929532f6287b9f076762a15bd317960f01cfe10bd7ac4459398c7ad8","observation_id":"12a095fe-25a3-4459-a866-42967aaabfac","resolution":{"observed_at":"2026-08-07T05:46:43.483133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.486401Z","title":"Here are the given event: {} Just give the chains only","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.486401Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3e9bb484de89990682a533e03a1424d74422e3ec6749f0013c8c72f7c4c6a3f8","observation_id":"c357f949-f7b8-493f-a549-6aaa27ce54e8","resolution":{"observed_at":"2026-08-07T05:46:43.486401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.493630Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.493630Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ea630b83eb8702dd8a5a17af59e4deae7ad120364a3b5067fd3c13184649c3b2","observation_id":"29481e9e-49f6-4317-b3a4-a580c3f84aff","resolution":{"observed_at":"2026-08-07T05:46:43.493630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.496867Z","title":"The intermediate events in the causal chains cannot appear in the question","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.496867Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:80f0c2d7e2b72777f9d6ef43298dff9155e327abed95191d696f46bd171a8a17","observation_id":"ac87bcaf-1eeb-46ff-b6c0-3ef3cbfebf2d","resolution":{"observed_at":"2026-08-07T05:46:43.496867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.500638Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.500638Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8b633a0683798a5cf66247a75db9b00917ef5b594beec9903a9df42750d907d9","observation_id":"58aac345-40e0-4142-a86c-0c9ae85dd62a","resolution":{"observed_at":"2026-08-07T05:46:43.500638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.505851Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.505851Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9da070a6fb066eca42c8a98ec3c9e6b09c91e2bf70f99a4e0800400b765faf46","observation_id":"60f0d02d-d13d-40fe-abd1-3b22bbd69258","resolution":{"observed_at":"2026-08-07T05:46:43.505851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.513574Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.513574Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4861400eb46c3f23e750b672008cd2d577370e3ad0b5d896a0cb6c3775eff656","observation_id":"08f7e2a2-21be-41ca-be61-481cede781b7","resolution":{"observed_at":"2026-08-07T05:46:43.513574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.537000Z","title":"-in the second causal chain, the transit is NOT interrupted by the intervention","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.537000Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ee525a29370ab93331991492c20064f37e14af6f7ead3ac0fa598aca1dfddf3e","observation_id":"a74a723d-c2e9-40e5-9d44-4488300e82b8","resolution":{"observed_at":"2026-08-07T05:46:43.537000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.540312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.540312Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:1def65ad6ca5e2b63842c131bd8149cea327706372d8c11c97eb44e78f2c66a5","observation_id":"a97ce373-55b1-4fe3-be15-d8d49df3e969","resolution":{"observed_at":"2026-08-07T05:46:43.540312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.543538Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.543538Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8a052abd67dcf03f76ff45218e4d7d5ec67d672228d1db12b93de1e6c21d5d6e","observation_id":"2942cd82-8b9d-44d2-b110-2cdebbca9627","resolution":{"observed_at":"2026-08-07T05:46:43.543538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.546681Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.546681Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:06767e6a6af66dc896051ecc8db8776a7995a9e407d19f7008337fbf5cb20fe6","observation_id":"04aed6eb-9ad3-4cb5-88df-b0defc94e4a5","resolution":{"observed_at":"2026-08-07T05:46:43.546681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.557001Z","title":"Causal Graph Proposal and Com2 Synthesis: Counterfactual After understanding the causal chains, we need you to create a multiple-choice example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.557001Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:457ffe33aa597f5dbeca48be58d0c7176646f737005add09ac3a3c1c4b98a20f","observation_id":"1c5ed77d-4691-44fb-bfe1-5a0c4f29a709","resolution":{"observed_at":"2026-08-07T05:46:43.557001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.563523Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.563523Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:585eac23de124df08cd20c232ea249003a226399ad51fe06357fab11bafd1ff4","observation_id":"000d7d64-d507-4d92-a748-fb13a0706252","resolution":{"observed_at":"2026-08-07T05:46:43.563523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.569970Z","title":"If A leads to B not C, what will happen?)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.569970Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5e6fdcddb16e8c59039bb985a688f7a15050efd22e28363a33365bb8dda10931","observation_id":"43268cea-bd3e-4ae0-8137-e38abaa6e4f8","resolution":{"observed_at":"2026-08-07T05:46:43.569970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.573169Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.573169Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5fbced198d4e4af2d97329be856b96db4f060a141d3c457b3f3607489a1ec006","observation_id":"f71c91cf-5709-4462-ad18-de366fc13e99","resolution":{"observed_at":"2026-08-07T05:46:43.573169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.576382Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.576382Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c783c3f6199556965a5655f805a02ae1d9dc4f2c3c3c325146d1b84cf3f3cdef","observation_id":"9b65f11f-0a80-4f66-ac3b-3d5b38776dfb","resolution":{"observed_at":"2026-08-07T05:46:43.576382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.583372Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.583372Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6e1188b55a2cc8e3b1f27da909dfacfa69e5ae5a4f85cf1e04a74dc59e81be24","observation_id":"2d6cb294-a0cb-49aa-aaa3-4307b1e6ecad","resolution":{"observed_at":"2026-08-07T05:46:43.583372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.586604Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.586604Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ea549556592e3133de7574550bde21b30fba2e9d43cfe9b9eecd6f9fb0808db2","observation_id":"081e3ae6-d688-451f-93d3-a21c945d9066","resolution":{"observed_at":"2026-08-07T05:46:43.586604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.589852Z","title":"Causal Graph Proposal and Com2 Synthesis: Decision After understanding the causal chains carefully, we need you to create a multiple-select example","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.589852Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ef58a033269a3217adb3a34a817e2fa0b63377aaa667b8d857bc7215634b6953","observation_id":"1925c1e2-f4ae-4863-ad93-4d3bfe224fe9","resolution":{"observed_at":"2026-08-07T05:46:43.589852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.593006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.593006Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6624a52447d6469d57bf78976d9f975f5476d0eb72cd705907b3e5a45c0740e6","observation_id":"b7a57e01-9a50-448f-9d24-68a828221d6d","resolution":{"observed_at":"2026-08-07T05:46:43.593006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.596230Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.596230Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7304a4c1d600577f7c1c186619c93ff0f696eb04faa3b602318df042fba2a1ef","observation_id":"8dbbf188-31e2-4359-8a39-f1dc571e0198","resolution":{"observed_at":"2026-08-07T05:46:43.596230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.762753Z","title":null,"venue":null,"work_id":"a68bd88c-808b-49b0-b064-4f5a2667e4e6","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.600191Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:becd7f2f937f5c44a7e84e220c2b6cc61f7e94f6ba6052fa4447e7618b25fdda","observation_id":"1d79a7d2-d965-49f7-a57a-7c8a66a1ffc7","resolution":{"observed_at":"2026-08-07T05:46:44.766231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.751504Z","title":null,"venue":null,"work_id":"aa7fde0e-6248-4310-9574-8d44d58152a2","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.603661Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:1fa226f7833606c0f1bed900e6c80d1aa6358ac1be81081c59afda0c9705e374","observation_id":"2241619a-8c44-43e6-803a-577e19153ad8","resolution":{"observed_at":"2026-08-07T05:46:44.755661Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.741099Z","title":null,"venue":null,"work_id":"636e768f-1b25-4ca0-a89d-57bd10d96e1d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.606823Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4da89ac724ac04cb07d9caf38117ee6fd4990e0774eb09413d37710c04f45531","observation_id":"d714b3d5-d098-468d-aea9-0f531eeed43e","resolution":{"observed_at":"2026-08-07T05:46:44.744430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.731205Z","title":null,"venue":null,"work_id":"c790534b-40f8-41b1-b96d-23a40e4e3885","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.610320Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:126aeb824d3bb378bbfbd5c4b5bb05e0b5aa9d55dd93f97e2c6f70f518dc0a09","observation_id":"e753c40b-ab45-4ce6-9e84-b126c75b14e3","resolution":{"observed_at":"2026-08-07T05:46:44.734736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.720810Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":"c5bc48e0-6652-44cb-b781-6de71759717e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.613567Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:a250e0845effb18c0c9c62597d17d5d35e0ef89e725f91b64fcbe40dc3ab9719","observation_id":"619fcc26-c906-4a8a-8bb1-3c0cfb42494a","resolution":{"observed_at":"2026-08-07T05:46:44.724466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.710605Z","title":null,"venue":null,"work_id":"19fdf480-09ad-4905-b970-627bb9e6e952","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.620116Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:2f8fefdc7dc1f8412247ac4ee2c1a2b9ff2012eb610e018850c5b9b6c270f62f","observation_id":"15fe1977-c3da-4c77-875a-c1a4984af72f","resolution":{"observed_at":"2026-08-07T05:46:44.714215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.700019Z","title":"Causal Graph Proposal and Com2 Synthesis: Transition After understanding the causal chains and the scenario, we need you to create a multiple-choice example","venue":null,"work_id":"679484f0-74fe-4f0a-98e2-3e233e134a94","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.623460Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8b751739a06646d9b4e8184a5af8a1c1b71adce51066111463cb2f27258ca554","observation_id":"38b71eee-f45f-4aa8-9bc5-7f2df2674c29","resolution":{"observed_at":"2026-08-07T05:46:44.703940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.627585Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.627585Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f2875db336fc5d6921392dcab0873211a05884b2373dc97ff67e8b960dbed2e0","observation_id":"c70042be-2893-43ae-a240-a07fb643290a","resolution":{"observed_at":"2026-08-07T05:46:43.627585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.689895Z","title":null,"venue":null,"work_id":"53045a2e-07fe-4c6e-87e0-8e20534045f0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.630839Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e08f95bb63e7db3063f0c284758882f1b883e79866d4fd3ef24843a6564f784a","observation_id":"1e830549-32e0-4d46-aefe-5ab713124a8b","resolution":{"observed_at":"2026-08-07T05:46:44.693445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.634254Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.634254Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:3f3ce131148f679fcb61cf19be26d4919d0f0ca071b5e5df3b515acfa5130d36","observation_id":"cc94e312-be9c-48ab-873d-20b5bd20cb04","resolution":{"observed_at":"2026-08-07T05:46:43.634254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.679134Z","title":"-threshold effect: the influence of A on B is not enough for B to cause C","venue":null,"work_id":"efea957b-3d7a-4ccc-aa79-e64f34f83ccc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.637822Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:0c7d7c7fa7225806ed3a350842a4706dc982858815e25584eebe4b5f35bfe106","observation_id":"618947f1-98bc-4764-aa4a-f658ab84e5e9","resolution":{"observed_at":"2026-08-07T05:46:44.683003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.668654Z","title":null,"venue":null,"work_id":"c072107b-d450-4e3d-9fa6-3e1ba81a876e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.641277Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:76a0ccbe6d04147dbc1b4e59bb69e103286547bacba32cc9a41081bc6b8bb779","observation_id":"576114e2-e806-4759-9760-68b6473e2237","resolution":{"observed_at":"2026-08-07T05:46:44.672073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.658508Z","title":null,"venue":null,"work_id":"eb659f51-b058-4caf-9515-5dc574a43fe0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.644613Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5addcb88b8b2091ba5e1785edf5452a6c897c1041c575e5e92be1f01a7420d1e","observation_id":"3e702613-5cd7-4358-abaa-900601c605f8","resolution":{"observed_at":"2026-08-07T05:46:44.662167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.647975Z","title":"-Method Reuse: For some problems that can be transformed into classic problems (such as the shortest path or knapsack problem), you can quickly reuse existing methods to solve them","venue":null,"work_id":"2ae9cd8a-d7cb-4ed8-900d-901be07315bc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.647813Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:fd4ddf75efbccd6da7a5003fae4caf501e834f6bde3d87a2127f91da0b85d3ef","observation_id":"cd8ff9e8-aef2-4ff1-9e48-102d868b3e62","resolution":{"observed_at":"2026-08-07T05:46:44.651848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.637571Z","title":null,"venue":null,"work_id":"240dff1c-7983-46be-b29c-80f7bb707807","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.651591Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8ac3fb3281f1c7376f311cfbc3434cfa0871004466bbe8d4b4a2cac15018d17f","observation_id":"d9010995-74dc-47f4-81ec-ac36ef2f046d","resolution":{"observed_at":"2026-08-07T05:46:44.640969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.655041Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.655041Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:d4c70fc66dfec7becb316ce2339d3defde869a404cd978877061bba1b72d18dd","observation_id":"10aed4ba-80b0-4b55-a0eb-6cbad5cb8fa5","resolution":{"observed_at":"2026-08-07T05:46:43.655041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:43.658263Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.658263Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:8276fc902307ccc6a5093e5979eda2582e371f11d26fde8a6eb830725bc7bd11","observation_id":"7826e87e-d724-48c3-b3ed-3ab4abd98f50","resolution":{"observed_at":"2026-08-07T05:46:43.658263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.627590Z","title":"None of the above","venue":null,"work_id":"5e91b96b-6888-4313-999f-9f395012e014","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.662483Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ee44a2cc442423d3b1768904a1092ccf03749052bbbfcd7f79a00287012b55fc","observation_id":"e8d64efb-9c3b-4e50-82a0-671a3e01ee3a","resolution":{"observed_at":"2026-08-07T05:46:44.630974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.617513Z","title":"Ignoring health issues typically leads to worsening conditions","venue":null,"work_id":"ac591aca-2d8a-4869-83b3-4790b54dff5e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.667240Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7d202a744bcd89386b1911bcf87d8b115db89cba70d72c249a2a2b0d9eee6e46","observation_id":"dbe2fcd5-17d4-428b-9dbe-9b1e36c2b8e0","resolution":{"observed_at":"2026-08-07T05:46:44.621297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.607005Z","title":"One possibility is that she could start feeling better due to the body’s natural healing process","venue":null,"work_id":"ec511afe-ed66-443b-a485-d568d353d20f","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.670792Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4ba3ea989b4be443fbe9125466a895046ad5a86675c7fc89ae4a467c15f60331","observation_id":"fac59214-cfa7-414a-a8b6-8ff23cc32731","resolution":{"observed_at":"2026-08-07T05:46:44.611163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.596678Z","title":"Option A suggests she would feel better, which often isn’t realistic with persistent symptoms","venue":null,"work_id":"0680616d-573b-41c4-bee0-167865b2593c","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.674469Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:66f7bb94ef5a7fa91f9b3afa4a06f8ca127a41417d82608f80711f4fcbbb33d9","observation_id":"ae8eba59-9241-4bfb-b1ce-ca5eac50e170","resolution":{"observed_at":"2026-08-07T05:46:44.600316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.586626Z","title":"If she continues to ignore symptoms, it’s likely her situation will worsen instead of improving","venue":null,"work_id":"7ab517c9-8515-49a9-9ce4-489e5f38e18c","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.678147Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:411597591558cde2654f44f38a1a77171d6db4d5eaeae19357b617744422c103","observation_id":"3a3dffea-1107-43db-804d-7f9d93935ea2","resolution":{"observed_at":"2026-08-07T05:46:44.590208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.575779Z","title":"By ignoring the symptoms, one possible severe consequence is a sudden health crisis necessitating emergency intervention","venue":null,"work_id":"df19cda4-fa09-48a4-97d4-08f3d8e1e850","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.682687Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:20e635da375e577c6894686bab262c527fdd481a0340cd9ec861c11ffe7c23ac","observation_id":"48d5a0f5-04ed-4c03-b821-149823af8b04","resolution":{"observed_at":"2026-08-07T05:46:44.579809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.563292Z","title":"Considering realistic scenarios, ignoring serious symptoms often leads to drastic health declines rather than recovery","venue":null,"work_id":"123ee9d9-7494-41d4-b9d9-6d8462e1f419","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.686576Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6ffa0453491944cd77197928383e54c44d4840b5ef6fd9dc516261831ff06b69","observation_id":"37f3d135-161a-44f8-81be-97e3f45312a9","resolution":{"observed_at":"2026-08-07T05:46:44.568211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.551408Z","title":"Decison in Com2-main Question What interventions can prevent severe consequences during a hot air ballooning experience that could lead to disastrous outcomes? Options A","venue":null,"work_id":"81c557f7-a7e5-476a-9975-8f718989650e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.690185Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:166daea2a366b5523e59c7d43759a92802ef847b1ca0bce8f3f570f4a91c502b","observation_id":"d753a7ae-9fb7-439e-bc17-9963b571f6db","resolution":{"observed_at":"2026-08-07T05:46:44.555254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.540908Z","title":"I need to focus on preventing issues related to equipment failure and extreme weather","venue":null,"work_id":"eb45a4f1-1573-49c7-a609-96ae19eb1cdc","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.693755Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:18a88f9d6ca924134f926cd09935d82e3ed380c66e4f0d44ff5e95420470ede9","observation_id":"03f0e1d3-c1cf-4926-9791-f8f90e1c6965","resolution":{"observed_at":"2026-08-07T05:46:44.544450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.530858Z","title":"Option A refers to equipment checks and could help avert malfunctions, while Option C emphasizes pilot training during severe conditions","venue":null,"work_id":"9e5c357e-0c8f-4f1c-a9d8-24b12c349944","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.698070Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:7e4abc76d3073a6bdf9d42a473e31b1ee5cabb9dd257654ec373b0fd404151a9","observation_id":"78ebe1fc-57c2-4b61-a788-96620cd2ca2a","resolution":{"observed_at":"2026-08-07T05:46:44.534529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.521103Z","title":"Both suggest ignoring critical safety precautions and could lead to disastrous outcomes","venue":null,"work_id":"5cbec5ac-4dc2-4562-bf38-91829d2b6fca","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.702583Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f797546e7aba09a17cbf1c2754688b3a01aa791cd1481d02ae46fd67f1c5ffd5","observation_id":"84d89c0e-c20c-44b9-a1b8-2deab4048078","resolution":{"observed_at":"2026-08-07T05:46:44.524579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.510918Z","title":"Grouping this way highlights which options can truly help prevent severe consequences","venue":null,"work_id":"914b04b5-2c1f-47bf-b46c-52bd5fc615a0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.706236Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e6542e641de771b53444b31890f917a035dc19a93c510f52084e64ea99be64df","observation_id":"2a3b0cbf-0f63-416f-bb37-adb9561e4577","resolution":{"observed_at":"2026-08-07T05:46:44.514659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.499915Z","title":null,"venue":null,"work_id":"34902885-4db7-4650-9dbe-f65cd4a9e560","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.709877Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:13847b87f2d54eb2ab7d1843666bc9d2e4ffd7180e1fb9861451af03353b5b4b","observation_id":"3399a491-3506-448f-a4e6-69d7fad5af9b","resolution":{"observed_at":"2026-08-07T05:46:44.503529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.489743Z","title":null,"venue":null,"work_id":"f3a0c1ec-a74b-4d28-81e9-60100240884e","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.713198Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:49eee8b42b7f968e4c4b08defe02c28c0c021bb48b1e1b6f4703177c3fbb24a1","observation_id":"12a7410c-7bb7-4dc1-90a0-499646a1729c","resolution":{"observed_at":"2026-08-07T05:46:44.493311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.478718Z","title":null,"venue":null,"work_id":"2d033e5c-a804-425a-bceb-19ef8d6f2b46","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.717309Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:4b9ded0a44894ccf59fdd91a9fbf0b868bbfabfb9230e948f33714ca5f34dfdd","observation_id":"e19d181a-3a65-447d-81b5-b818a49807c3","resolution":{"observed_at":"2026-08-07T05:46:44.482149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.468493Z","title":null,"venue":null,"work_id":"1ce4ae74-ec05-490a-bb95-2b745736b087","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.721863Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9e3fdab013dd93906c0068f57216f516a3a604b3bef39b57b8457a29cf3077cb","observation_id":"6f4be258-7ca4-45c7-a38e-b51fc98ab53d","resolution":{"observed_at":"2026-08-07T05:46:44.472045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.458362Z","title":"In this case, the typical behavior of the coin changes significantly compared to a normal environment","venue":null,"work_id":"577533a7-7008-4c99-aad6-7e036606ec8d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.725715Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:109e1ff4e6a2cd7dd3082a7cf74ed6106ed7f1bda9ad58baa0532fdf0e784764","observation_id":"d9ead090-6b34-4408-9616-55c4631bcb11","resolution":{"observed_at":"2026-08-07T05:46:44.462072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.447802Z","title":"Option A suggests the coin lands on a table, which seems unlikely in zero gravity","venue":null,"work_id":"70826063-41e0-4c22-b25f-fb3e5ff6e1c3","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.729766Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:1c4d72049b317ae8519ef0533ed1eace2d08428c05408f6bacc15e2a705ec97a","observation_id":"c6bc47c0-e4de-42f1-b02f-415994d93f25","resolution":{"observed_at":"2026-08-07T05:46:44.451731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.437155Z","title":null,"venue":null,"work_id":"bf2f8aee-0a53-4834-a5a9-0b31f9442588","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.733351Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b6815f200e027d8dd9c7f880041991178cf8f7845514825f8b23be77a705877b","observation_id":"42d0639f-56f7-4204-8bb2-a64dfb1769eb","resolution":{"observed_at":"2026-08-07T05:46:44.440734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.426997Z","title":"This aligns with the idea that the coin would continue to drift until it encounters something","venue":null,"work_id":"8e2d3d18-db9e-4baa-bb5e-9d3298881267","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.736851Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:72703f22974e43290bb2c2d5d668712ef1c9c5b289e8323ecb91aaeaacf9758a","observation_id":"4fb931e2-3f75-4554-a05f-6119d31eff4a","resolution":{"observed_at":"2026-08-07T05:46:44.430656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.416674Z","title":"I need to correct my reasoning","venue":null,"work_id":"f72a64c4-8118-4422-99d6-1527bdbbdd38","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.740305Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6fdb528e6755c3977140df86dabb24b39da5868d91701a5b59e9234cbd13acef","observation_id":"7cf4ec47-c442-435b-9571-070170354967","resolution":{"observed_at":"2026-08-07T05:46:44.420056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.405185Z","title":"Therefore, the only logical outcome is that the coin would drift and potentially collide with something","venue":null,"work_id":"582f8936-a710-4fe8-8748-f66deea97844","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.743723Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c9cad12688cf5a3e6f75f03bdfbb60d1fbbe99ffe47b7406371404a54864ba26","observation_id":"b5397b6f-1c7b-455f-b678-3dcc03f21188","resolution":{"observed_at":"2026-08-07T05:46:44.409418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.395183Z","title":"Simon was seen in good spirits before the wedding but became agitated during the ceremony","venue":null,"work_id":"25622c5f-427c-4bb6-b86d-8f2aab7465d0","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.747320Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6f0cc0be2af7cb816969ecb0af817cbaa94ce0802f7d0e94401a76bb9775c5a2","observation_id":"f1a66e9a-2eff-40e3-8301-6ae2d9bff78f","resolution":{"observed_at":"2026-08-07T05:46:44.398838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.382983Z","title":null,"venue":null,"work_id":"9c3fc257-6748-4025-b0de-aae29c53e408","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.750703Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:31c03ceaaa7752f3d1cbf74c93db4643903cb687c5408973797cffd4089a5fb2","observation_id":"69665cac-3d85-4aaf-a131-8746445e71e2","resolution":{"observed_at":"2026-08-07T05:46:44.387169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.371643Z","title":"Simon spoke to her maid, Alice, and mentioned ¨jumping a claim,ïndicating a prior relationship","venue":null,"work_id":"5732e2de-60b0-4b17-bbdd-f4581c5508e7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":106,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.754075Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:6fd399d4e88abd651d2df1bcabba47a62c96ccb7649317799d34484a7883ca16","observation_id":"71afbee0-1aeb-44b6-92be-722b12e6e3b3","resolution":{"observed_at":"2026-08-07T05:46:44.375705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.360802Z","title":"Simon left the breakfast table shortly after the meal began, dressed in her wedding attire, and was later seen leaving with Francis H","venue":null,"work_id":"09276c27-4fa3-4c9c-a471-b76e62e8b18a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.757695Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:174adf581885f80a72aceaf18e7a4a3dab99a5cafe4854d9d7068163131ab509","observation_id":"b0b8bdd2-0ef6-44aa-bdbf-db96c0d63c2e","resolution":{"observed_at":"2026-08-07T05:46:44.364951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.348780Z","title":"Simon’s wedding dress and belongings in the Serpentine, indicating she had left in a hurry","venue":null,"work_id":"2efde9ef-05a3-4967-b4e2-fd5a93b341a7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.761539Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:540c108771309a5b9d2c48a0ccee3a5a7a8fa20629d2fa303fac1c8047787520","observation_id":"9146a024-d60e-4c70-a49b-5e7f6e9c90c0","resolution":{"observed_at":"2026-08-07T05:46:44.353091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.338800Z","title":"elopement)","venue":null,"work_id":"a0988de4-1d67-4caf-9a5a-e4e3c5e9bf79","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.765900Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:c177c6213ba54e6d16c36e81435f5e1c327cfe6885ee9be2c552befd14eb9470","observation_id":"cfec5eb4-4569-4e6a-aa3d-4858909d2b67","resolution":{"observed_at":"2026-08-07T05:46:44.342224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.328124Z","title":"Options A, B, and D seem proactive, while C could limit the social aspect, and E is dismissive","venue":null,"work_id":"edd33550-5ce0-4b46-b506-b806bb9ce377","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.769389Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:e5ca55fc17bbcccd76c1bcc75a2c49ccbb384577d8373e467d63075914850dc2","observation_id":"d1935e6e-5b99-4228-8d98-209eda105e44","resolution":{"observed_at":"2026-08-07T05:46:44.332077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.318305Z","title":null,"venue":null,"work_id":"d2db916b-59a5-4cb6-813c-dfcf92fe2c6f","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":111,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.772823Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f135173dadf4fb9f2d294842df64491fed5903bbb7f94069286052e29bc1d722","observation_id":"4f0b596d-19e8-4be2-975b-0d458f51ae17","resolution":{"observed_at":"2026-08-07T05:46:44.321761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.307406Z","title":"For example, ensuring the bride’s emotional well-being could prevent her from feeling the need to elope","venue":null,"work_id":"ab079cc9-9298-459d-bec1-cc064822833a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":112,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.776381Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:9a33aed3d293e8afa692e4136c08bff653750d595ad1bbd3bfcfd64f146096a8","observation_id":"84226964-f6df-4e9f-9d21-3983c4b1af47","resolution":{"observed_at":"2026-08-07T05:46:44.311449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.296680Z","title":null,"venue":null,"work_id":"77e15878-5331-4f8c-a63a-da38196bcf99","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.781733Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f3fc5cc418ba79641ec028754585d5bfee546e94541eab9dc90ae3be7593193a","observation_id":"7f9f9f3a-c009-4198-9bb3-02308d39d7f6","resolution":{"observed_at":"2026-08-07T05:46:44.300502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.285474Z","title":"Intervention in Com2-hard Crime A valuable coronet, containing thirty-nine beryls, was stolen from Alexander Holder’s home","venue":null,"work_id":"5b07fcac-769b-49ca-aba5-204120101255","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.785921Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:babd23f7a0a6e905c27a2943503e3e2425db392d5169e41e675bc08c94c91289","observation_id":"01f9faa7-2d00-4cf8-a914-19790ca71a57","resolution":{"observed_at":"2026-08-07T05:46:44.290027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.274584Z","title":null,"venue":null,"work_id":"c788a2bf-146a-4219-b288-0cfbd4b2a0b7","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":115,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.789294Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:f2a99cc9788a3f4e955c1b79c347e8f47f03fdf04a33919405c24524a4a59fed","observation_id":"4531ca8b-83b5-4f6d-b146-b7a6a9eb8d07","resolution":{"observed_at":"2026-08-07T05:46:44.278277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.264264Z","title":null,"venue":null,"work_id":"2651c4c9-8355-41bf-85ba-12ca231a2d9a","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.792591Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:365e1121723e896ae7d887c68abf47389026cd53a880a8dd2356596b4067b57d","observation_id":"77e03450-eaf2-4ad6-9bcb-1361f4eb417b","resolution":{"observed_at":"2026-08-07T05:46:44.267771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.254241Z","title":null,"venue":null,"work_id":"34580276-18d3-4858-9e2c-1b8483d476e3","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":117,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.795912Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:b3153e02f1b84f3deedc6b540161a844404bc0c51b772c659521e7b03b18b497","observation_id":"d0ea3148-4918-4e07-95e9-796a36cdc5bc","resolution":{"observed_at":"2026-08-07T05:46:44.257677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.243980Z","title":null,"venue":null,"work_id":"3305c911-a69b-4add-a030-7bbc200ae93d","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.799386Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:5fffa19cd7eb351adfa345cc4389951b7b73a83da0f76a9a4982ca7c866b3fbf","observation_id":"d346ce81-7360-4c61-8fb6-8e6c6c44c21d","resolution":{"observed_at":"2026-08-07T05:46:44.247730Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.233695Z","title":null,"venue":null,"work_id":"783900b2-c9e8-43cc-b0e1-860c2dcc5f61","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":119,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.802720Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:63eb45289659a82152474d0a3562076b00cdd07988129b5aba490581bb45e561","observation_id":"f58b1985-f79e-4f73-a822-ad2fc76cd99a","resolution":{"observed_at":"2026-08-07T05:46:44.237274Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:46:44.223017Z","title":null,"venue":null,"work_id":"db234145-18c8-4d1d-a0bb-f68aa8bb0378","year":null},"citing_paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models","version":1},"reference_index":120,"source":"pdf_text","source_observed_at":"2026-08-07T05:46:43.806230Z"},"links":{"citing_paper":"/paper/2506.07064"},"observation_digest":"sha256:ed9459ef29315f160fadd533f886959221b0b695cc68fc1ec115b738c0441861","observation_id":"206188e3-84e9-45e0-80d1-b8542a9908a3","resolution":{"observed_at":"2026-08-07T05:46:44.226638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07064","last_updated":"2025-06-08T09:53:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:40:33.675930Z","submitted_at":"2025-06-08T09:53:08Z","title":"Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":129},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 129 outbound references and 0 inbound Pith citation observations for arXiv:2506.07064."}