{"as_of":"2026-08-07T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f347c9b1cfc901623c6e551238bb1b60260fe646db1b72958512ae48e91362e8","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:04:23.688239Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.10693/citation-record","integrity":"/paper/2604.10693/integrity","json":"/paper/2604.10693/citation-record.json","paper":"/paper/2604.10693"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i16.29720","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"255ad1e4-3af4-4d00-9c60-1a05089076cc","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:056dd82e6f497bd6121715972d5553d6d3ca764d579616b38fc515e079c9fc12","observation_id":"337a03a6-bb87-47aa-8a8a-2904ac318973","resolution":{"observed_at":"2026-05-10T15:05:31.154304Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:19:10.190918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:19:10.190918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03559","last_updated":"2026-04-19T03:10:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-07T03:58:42Z","title":"DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs","version":2},"cited_work":{"arxiv_id":"2601.03559","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03559","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs","venue":"cs.CL","work_id":"8352d13e-6462-4129-bbc3-f5f3cf9dfe6c","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2601.03559","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:72c6a99bfdcc47e12d1d4950a0d73fff6b5e379cf6c2a6041e219c0e94d11000","observation_id":"713c8001-e001-427f-bb8b-777303885030","resolution":{"observed_at":"2026-05-11T11:16:03.937789Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:a4babdb1603afaf7e15cb3eeada928e80a7e5d3c859bf97fa63fe53736325302","observation_id":"6d42f2dd-9ea0-4cab-8aa1-4c1cc5c15610","resolution":{"observed_at":"2026-05-11T11:16:05.179356Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16540","last_updated":"2024-10-21T22:07:20Z","snapshot_observed_at":"2026-08-04T22:35:08.472561Z","submitted_at":"2024-10-21T22:07:20Z","title":"A Theoretical Understanding of Chain-of-Thought: Coherent Reasoning and Error-Aware Demonstration","version":1},"cited_work":{"arxiv_id":"2410.16540","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16540","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c0a4825f-88a8-456e-9156-77424585ba0f","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2410.16540","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:8f46b2a66989b951b5671cfbfed18aae7dbaadd7425ecdfdc4d3c6eafde64952","observation_id":"126eadaa-88dc-4328-b26e-6fdfc0153183","resolution":{"observed_at":"2026-05-11T11:16:03.944578Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"027de151-5c26-4e26-9b77-d2cfc77744f3","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:0f41b046e79ea48c3ad20ae4d88012fa495fa22feff4e7abef2e19292bd2d5ce","observation_id":"abfc155c-ae2d-4bad-9981-22810e4e855f","resolution":{"observed_at":"2026-05-18T08:52:31.433068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18239","last_updated":"2025-02-25T14:20:27Z","snapshot_observed_at":"2026-08-07T17:50:00.953698Z","submitted_at":"2025-02-25T14:20:27Z","title":"Unveiling and Causalizing CoT: A Causal Pespective","version":1},"cited_work":{"arxiv_id":"2502.18239","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.18239","snapshot_observed_at":"2026-07-02T15:57:06.740606Z","title":"Unveiling and causalizing cot: A causal pespective","venue":null,"work_id":"5f169f5d-eca7-46e4-a944-09383cd56662","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2502.18239","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:e66564e5c3e0ff64c69db5b84d938fd9aab318a0baa77bc1ae79cf669f750b85","observation_id":"319654b8-3c76-461a-b0c9-1bec76dd73a1","resolution":{"observed_at":"2026-05-11T11:16:04.312401Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.12573","last_updated":"2026-04-14T10:50:49Z","snapshot_observed_at":"2026-07-06T23:00:46.620106Z","submitted_at":"2026-04-14T10:50:49Z","title":"IDEA: An Interpretable and Editable Decision-Making Framework for LLMs via Verbal-to-Numeric Calibration","version":1},"cited_work":{"arxiv_id":"2604.12573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.12573","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"IDEA: An Interpretable and Editable Decision-Making Framework for LLMs via Verbal-to-Numeric Calibration","venue":"cs.AI","work_id":"e17eaefc-007b-4415-8bd4-8c831bcf7abc","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2604.12573","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:99d2a8c186355299a938f8d1e7ddd30272e8cb66ecfff0a8b6e30ffffb2cd8d6","observation_id":"52d1d971-5412-4ef6-8181-d86975b07fca","resolution":{"observed_at":"2026-05-11T11:16:05.095190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:e0f948fcd35df193dc76247341020aeab1fc6b83b9cbf46486444b39a275412a","observation_id":"79859c5c-014a-4fb8-a072-f7e399899538","resolution":{"observed_at":"2026-05-11T11:16:04.085032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23808","last_updated":"2026-04-20T11:06:36Z","snapshot_observed_at":"2026-07-06T22:31:00.843452Z","submitted_at":"2025-09-28T11:14:58Z","title":"Semantic-Space Exploration and Exploitation in RLVR for LLM Reasoning","version":5},"cited_work":{"arxiv_id":"2509.23808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.23808","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic-Space Exploration and Exploitation in RLVR for LLM Reasoning","venue":"cs.LG","work_id":"86d27ecc-d831-4145-9819-3b6dc9176aeb","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2509.23808","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:8baf7fbfc5ee141b1146cc15780bd9b5d0d3813b161c3c82a4be7202e1d36d95","observation_id":"259862a3-d9c4-4f65-bf06-9769b927586a","resolution":{"observed_at":"2026-05-11T11:16:04.676875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":"2310.01798","doi":"10.48550/arxiv.2310.01798","metadata_source":"pith","pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","venue":"cs.CL","work_id":"f63b261b-ef16-40f5-993b-9d37b1a51b92","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:759082a990cb5c72cd4fee27b9347e6ad224bdc547f1a411f13c51d03ac529e6","observation_id":"ff44dc42-452a-42cb-9321-ed415de877cc","resolution":{"observed_at":"2026-05-12T05:48:28.335998Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.048248+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.048248+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03767","last_updated":"2025-03-15T18:40:04Z","snapshot_observed_at":"2026-07-06T19:28:01.764884Z","submitted_at":"2024-10-02T15:33:30Z","title":"Reasoning Elicitation in Language Models via Counterfactual Feedback","version":2},"cited_work":{"arxiv_id":"2410.03767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03767","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning elicitation in language models via counterfactual feedback","venue":null,"work_id":"41125ca7-0ec5-43cc-a143-3c3b97099b0b","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2410.03767","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:a2e336edddbf12045b8679075329a18a4d3a3b3adddfffba08b1e80c7204df70","observation_id":"ad9889d4-46db-49ce-bd57-feace3eec278","resolution":{"observed_at":"2026-05-11T11:16:05.382593Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.23752","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12182d79-c0c3-4b57-aaf6-666757d4dc50","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:6b4fde775189b2fe46aa0dce1e5ed66000dc9d304cc148bf17fad9db0aaf9802","observation_id":"43a2bf83-755c-47b8-bb04-d1c8a9cc3f6c","resolution":{"observed_at":"2026-05-11T11:16:04.447342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66da5d57-25fc-4eb8-8bab-8646f276f3a0","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:b97989f2ef2d156dc7fbdf633bc48a8007aad97e5719dc5de4a26acc84ac3c92","observation_id":"119b7d89-4e5d-4146-9c79-3d4a9b87cb74","resolution":{"observed_at":"2026-05-18T08:52:31.425774Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.272","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Su, Camillo Jose Taylor, and Dan Roth","venue":null,"work_id":"b6b7e3e9-28ca-4202-8357-404874afb3f8","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:078202b0ea8c035a9873997426c2dfd59183ec6033bb83c4dbe0db277257d2cd","observation_id":"d6fdbbbf-cc39-4328-baec-50aecf4f9262","resolution":{"observed_at":"2026-05-10T15:05:31.143695Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T10:52:18.33735+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T10:52:18.33735+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.825","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLMLingua: Com- pressing prompts for accelerated inference of large language models","venue":null,"work_id":"629b9d0e-ed05-4694-ba5a-e81b8d5751dc","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:e1da79e1c1900533d8cbfe8cd31ce68f5aab4c23ed2a314f43c5bdd42dd120eb","observation_id":"67a25d73-3e02-4b43-8d0d-5dfe44a2617e","resolution":{"observed_at":"2026-05-10T15:05:31.147648Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:42.680868+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":"2207.05221","doi":"10.1145/3618260.3649777","metadata_source":"pith","pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models (Mostly) Know What They Know","venue":"cs.CL","work_id":"8ca58a10-da41-4f70-baae-7e449512e345","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:89b179c4e26d083a73913ce6eef43db77d13b4a3715b644e1144c96e4d468b17","observation_id":"bdbfbe7f-d096-4800-86aa-c8e58cc30950","resolution":{"observed_at":"2026-05-11T11:16:03.735044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:13.382372+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":"2205.11916","doi":"10.48550/arxiv.2205.11916","metadata_source":"pith","pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Models are Zero-Shot Reasoners","venue":"cs.CL","work_id":"d9b7eb1a-7165-46ff-9f06-d2f0b9d6f95d","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:51be92e347cff9f57f781df9ce2c85c531a87bf14c91b0a9b6af184aee513edc","observation_id":"aa24b806-aa1a-47bc-aefe-f25b854df89d","resolution":{"observed_at":"2026-05-12T19:04:13.904485Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2307.13702","doi":"10.48550/arxiv.2307.13702","metadata_source":"pith","pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","venue":"cs.AI","work_id":"86ca07b8-4628-4f51-8938-a82683386ae4","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:e708d95e64f993fcbeb608ed931ce364741c77edf54ef29e20b1362f0d9407e4","observation_id":"ab7b35be-9be7-4c64-9d79-c8c0ce0e5325","resolution":{"observed_at":"2026-05-11T11:16:04.746109Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17123","last_updated":"2026-05-21T12:25:44Z","snapshot_observed_at":"2026-08-03T06:01:46.333933Z","submitted_at":"2025-05-21T17:59:12Z","title":"MTR-Bench: A Comprehensive Benchmark for Multi-Turn Reasoning Evaluation","version":3},"cited_work":{"arxiv_id":"2505.17123","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17123","snapshot_observed_at":"2026-06-29T17:53:47.454761Z","title":"InProceedings of the 44th International ACM SIGIR Conference on Re- search and Development in Information Retrieval, pages 544–554","venue":"cs.CL","work_id":"b7d0aae5-a2d0-4098-bc16-5d1ee016fa67","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2505.17123","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:0630c94cebd6009431a6dfe5716581310547c534ec88e7b653df651eb08e0a27","observation_id":"5b9152cf-ae50-4834-8ae8-061965b22864","resolution":{"observed_at":"2026-05-22T02:03:47.199549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06794","last_updated":"2026-04-08T08:06:45Z","snapshot_observed_at":"2026-08-02T13:03:41.670370Z","submitted_at":"2026-04-08T08:06:45Z","title":"GCoT-Decoding: Unlocking Deep Reasoning Paths for Universal Question Answering","version":1},"cited_work":{"arxiv_id":"2604.06794","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.06794","snapshot_observed_at":"2026-06-30T22:45:06.536140Z","title":"GCoT-Decoding: Unlocking Deep Reasoning Paths for Universal Question Answering","venue":"cs.CL","work_id":"a1ca81bd-583c-4388-9e64-33a1da7a1dfd","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2604.06794","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:97807f96a3e8b6fa88cb0c9e64031bf25905b6aae13a2500d85cdcf853f6a4af","observation_id":"a884cabf-7ee1-42f4-a97d-35f5de84fb40","resolution":{"observed_at":"2026-05-11T11:16:05.561357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8d2eea3-2334-46d9-8794-d3605605cb3d","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:def54f9a33feca318b8fad976a9eae725f80ee3bdcbafdbddad3543d869c6525","observation_id":"9b1733f9-e0f6-4591-ba82-21055a25d240","resolution":{"observed_at":"2026-05-18T08:52:31.423457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b9146e75-9d4b-463c-a9f9-3179ebbfdb6f","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:8cd3455d5322cbcc937dd70924ab188fa16ccf95edb5769bda8eabf89bd4e234","observation_id":"22473257-19bf-45d2-bd57-0572622c77af","resolution":{"observed_at":"2026-05-18T08:52:31.428124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7ecae59d-0329-4067-abf8-15aacdd22a9a","year":2009},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:0532da1d011945573a3792d955418c85312989f2a02bf3273edb21f48c498887","observation_id":"ce11ae76-e678-49db-becb-648fc2833a90","resolution":{"observed_at":"2026-05-18T08:52:31.430712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11768","last_updated":"2023-07-25T04:01:43Z","snapshot_observed_at":"2026-07-06T15:57:04.900537Z","submitted_at":"2023-07-17T00:54:10Z","title":"Question Decomposition Improves the Faithfulness of Model-Generated Reasoning","version":2},"cited_work":{"arxiv_id":"2307.11768","doi":"10.48550/arxiv.2307.11768","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.11768","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2307.11768 , year=","venue":"arXiv (Cornell University)","work_id":"842cb6c9-8e58-44b7-a293-8b5454f7b29f","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2307.11768","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:9596862fdb9b4abd8b39bc22599b2030971f7ee44bdb2835d64c827775fc1d2a","observation_id":"4529706e-cc37-4397-9eb3-26f70fcd65aa","resolution":{"observed_at":"2026-05-11T11:16:04.599387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10379","last_updated":"2024-06-02T16:01:35Z","snapshot_observed_at":"2026-07-06T16:08:17.076884Z","submitted_at":"2023-08-20T22:36:23Z","title":"Algorithm of Thoughts: Enhancing Exploration of Ideas in Large Language Models","version":3},"cited_work":{"arxiv_id":"2308.10379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.10379","snapshot_observed_at":"2026-07-04T08:39:42.633912Z","title":"Algorithm of thoughts: Enhancing exploration of ideas in large language models","venue":null,"work_id":"c0a9c845-2388-4297-8b52-4f36275e63c9","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2308.10379","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:b918a0cc1183eb869a2912c0477eaeeabbc7008937879e119eda6e2f767105d4","observation_id":"b48a5221-37ca-4d3e-a7f5-dcf401bfea66","resolution":{"observed_at":"2026-05-11T11:16:04.856079Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04040","doi":"10.48550/arxiv.2510.04040","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Faithcot-bench: Benchmarking instance-level faithfulness of chain-of-thought reasoning","venue":"arXiv (Cornell University)","work_id":"ff356356-9411-4fd8-a017-cb58a9e08bd8","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:3e3d178c353f2e91f3fd04b1cb7df8601cb4c443077bf0b8036f10914e0d73f1","observation_id":"df891ae7-0e83-4757-af5f-ad4286ca716d","resolution":{"observed_at":"2026-05-11T11:16:03.375799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.05524","last_updated":"2026-04-14T05:38:03Z","snapshot_observed_at":"2026-07-06T22:41:15.345760Z","submitted_at":"2026-01-09T04:35:21Z","title":"Double: Breaking the Acceleration Limit via Double Retrieval Speculative Parallelism","version":3},"cited_work":{"arxiv_id":"2601.05524","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.05524","snapshot_observed_at":"2026-07-04T13:29:52.146439Z","title":"Double: Breaking the Acceleration Limit via Double Retrieval Speculative Parallelism","venue":"cs.CL","work_id":"359a948c-0f33-475f-9c74-af71ed9282c0","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2601.05524","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:4b307d29d52359c545a89bf99825856a7a99a7120d63976455c9f9bf2959e81a","observation_id":"eaebdb6c-e3d9-4ced-aa8c-836b4b0d3359","resolution":{"observed_at":"2026-05-11T11:16:04.979357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2b140f66-2bfd-4129-a8ba-fb219485eeef","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:25c1acdec512a23f3603f00c83014781e4b993d51d19e17ec9cceb7bd82fe367","observation_id":"9da4d60e-ff58-4f1c-998c-0fc83ddf6fab","resolution":{"observed_at":"2026-05-18T08:52:31.436519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2244377b-a538-4881-a415-0a43f67ebb6c","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:b98bd1767842e9775d8253db1f53ca7be63cda00dc7b434a965d8a756d79f72d","observation_id":"8d3b417e-1759-4085-b237-d61861e3285a","resolution":{"observed_at":"2026-05-18T08:52:31.417003Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23989856-77e2-4e10-9359-6ab260f956ad","year":2019},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:3e8ad554ae23d8b4f61b6f230020daf32b72dfe9fd86c3dec1b5c6ecab225fc8","observation_id":"9b2c4405-8034-42cd-a6c1-47641c298250","resolution":{"observed_at":"2026-05-18T08:52:31.419139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b99e7de-c2b4-4b86-b293-857edbe3fd8c","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:3933f9471b81bd2f124bc5352acaed0a290fdb47967c699859536dd7e35d27db","observation_id":"13d03a13-e36a-47ca-aa2f-ab47d7c4d9f6","resolution":{"observed_at":"2026-05-18T08:52:31.421128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.06690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:19:55.980844Z","title":"Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation.arXiv preprint arXiv:2512.06690.2025","venue":null,"work_id":"e303d7f1-96bd-48e5-800b-c41246a1aaa3","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:05e0a6acbb77de8379c76e2def17c941920616a62c29ec17bc3b89cc84047111","observation_id":"df0a707c-c35a-4408-ba44-b220a6baf99b","resolution":{"observed_at":"2026-05-11T11:16:04.400359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:69148372d88368f64086151a9d9068347622f86663e2fef4c184250b561d0d58","observation_id":"b10ddc57-52f7-4030-83c2-121964dba714","resolution":{"observed_at":"2026-05-11T11:16:03.625004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cdf8e591-64f1-4621-92d8-b82d7c6cb7b0","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:83d51420b91861f032b2d6591f112147dad4e5c6c942a0fc06c64c97fad1826b","observation_id":"b652ed2b-a63b-4f52-9304-5d94befae1f8","resolution":{"observed_at":"2026-05-18T08:52:31.414847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"14709ce8-65b7-4dda-a55a-649fc6405555","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:96af12bd984b35d7e77e01b8370370d3eaff47383fdc45c338d9d3b92005e9de","observation_id":"83d2d2f9-3d95-4288-abd6-9dd9f2aeae5e","resolution":{"observed_at":"2026-05-18T08:52:31.410068Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:f5eac4e57b7c3b0155798b0eb374da1304951d753393cee103c551fe3044786a","observation_id":"2c2748b9-122d-4876-bc73-50b012b3e5d2","resolution":{"observed_at":"2026-05-11T11:16:03.346179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:13.648188+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20209","last_updated":"2026-06-20T07:35:02Z","snapshot_observed_at":"2026-08-03T07:23:30.345378Z","submitted_at":"2026-01-28T03:15:34Z","title":"Spark: Strategic Policy-Aware Exploration via Dynamic Branching for Long-Horizon Agentic Learning","version":2},"cited_work":{"arxiv_id":"2601.20209","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.20209","snapshot_observed_at":"2026-07-04T13:39:50.095543Z","title":"Spark: Strategic policy-aware exploration via dynamic branching for long-horizon agentic learning","venue":"cs.LG","work_id":"58dca14a-16b7-4946-bdd2-e911b0d52d5e","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2601.20209","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:012f3176c8ae875b799d8f9657d741d591d22339058845b6cefdd2f6168f0a1f","observation_id":"ad3be086-a48c-4955-b06c-209c53525411","resolution":{"observed_at":"2026-06-23T03:12:45.450322Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.758","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"0d67e625-e658-4e72-8906-b6d8585d9fba","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:fca701c4c133f04026054620bee08ff8169def61aa095365df7b78ba330b0a8d","observation_id":"658604d3-0269-41f7-9462-7ef3d79c4ec4","resolution":{"observed_at":"2026-05-10T15:05:31.150855Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14497","last_updated":"2024-04-18T07:27:00Z","snapshot_observed_at":"2026-07-06T15:32:01.532477Z","submitted_at":"2023-05-23T19:58:30Z","title":"Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement","version":2},"cited_work":{"arxiv_id":"2305.14497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.14497","snapshot_observed_at":"2026-07-02T21:07:23.498169Z","title":"arXiv preprint arXiv:2305.14497 , year=","venue":null,"work_id":"af0a9ceb-2a16-4d83-b084-8565903f341f","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2305.14497","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:27489105beabd727dc162dba4213da088f00e7e3a88c1c36a7b38f8679e9145b","observation_id":"417d7a9a-5b2f-483f-a9db-07fbaeecb262","resolution":{"observed_at":"2026-05-11T11:16:04.342357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5a23951a-da38-434e-92c9-a23093bb7d0f","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:9b7ce11343b3ae3ae173bc50c032e8bff558acf74b0aee7e44075e84c06257c0","observation_id":"c24f352f-58a4-42bb-b586-dd6abda49701","resolution":{"observed_at":"2026-05-18T08:52:31.412410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13774","last_updated":"2025-05-28T19:41:14Z","snapshot_observed_at":"2026-08-07T15:42:47.476737Z","submitted_at":"2025-05-19T23:20:24Z","title":"Measuring the Faithfulness of Thinking Drafts in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":"2505.13774","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13774","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24ccd1ed-4693-473e-b41e-17599071664b","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2505.13774","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:6b34642404c600332608ddf9a785e6dce2cb509f9a9af0044bb47ec4723df4ae","observation_id":"7729dbc3-4d62-424b-b6a5-fa630867821b","resolution":{"observed_at":"2026-05-11T11:16:03.312937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10740","last_updated":"2026-04-12T17:27:55Z","snapshot_observed_at":"2026-07-31T16:57:04.134695Z","submitted_at":"2026-04-12T17:27:55Z","title":"RCBSF: A Multi-Agent Framework for Automated Contract Revision via Stackelberg Game","version":1},"cited_work":{"arxiv_id":"2604.10740","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10740","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RCBSF: A Multi-Agent Framework for Automated Contract Revision via Stackelberg Game","venue":"cs.CL","work_id":"f015de39-6b99-4b17-86c5-374079ecf89a","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2604.10740","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:760ddf66d52a858184b3de6a74e4a3ade9398fa3d17698fc74fa528931fa4820","observation_id":"27e2b08f-5106-4d52-b794-043c5687c562","resolution":{"observed_at":"2026-05-11T11:16:03.515105Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10734","last_updated":"2026-04-12T17:14:36Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:14:36Z","title":"Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS","version":1},"cited_work":{"arxiv_id":"2604.10734","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10734","snapshot_observed_at":"2026-07-02T20:47:23.419196Z","title":"Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS","venue":"cs.CL","work_id":"d4454e5b-e1a2-4f19-a48f-9b25324d267b","year":2026},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2604.10734","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:e62b0406c9bbf69d924913c185dcfb1e115f8bd2f7df42b049ebe9602eb11a4b","observation_id":"be07489b-3d17-4692-80aa-f97ee811f225","resolution":{"observed_at":"2026-05-11T11:16:03.785135Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T21:53:59.525530Z","title":"How well can reasoning models identify and recover from unhelpful thoughts?, 2025","venue":null,"work_id":"4ba2f137-950a-46bd-86e5-57ee368e6ddb","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:4518eecd0c69277a946d566e4341c657b999ed64ae59ab6ca3c49baed2687ec3","observation_id":"43979ac9-db78-430e-8699-d6ae7c4ae7e7","resolution":{"observed_at":"2026-05-11T11:16:03.413408Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c4576b3c-9750-40b4-ba7f-0204a73497ca","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:ecc1f56e7b4b3c80e40656114e7c7b4365a046f54f5e10e2fb9fb7011bf7f3e1","observation_id":"21923122-3d6a-4d99-a5c0-48134e7782f4","resolution":{"observed_at":"2026-05-18T08:52:31.405004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03965","last_updated":"2024-06-17T05:56:00Z","snapshot_observed_at":"2026-07-31T07:22:51.146890Z","submitted_at":"2023-10-06T01:40:09Z","title":"Thought Propagation: An Analogical Approach to Complex Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.03965","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.03965","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff7f6464-71a1-4763-80b2-051a82f7f1c6","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2310.03965","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:46beb98ba1d63c09d168be50753f2ef936c458b1c888006ad71ce95130ddc552","observation_id":"8f8d9857-0bed-4a61-95d1-3bcbede60254","resolution":{"observed_at":"2026-05-11T11:16:05.273416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.09853","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:27:26.347712Z","title":"Causal sufficiency and necessity improves chain-of-thought reasoning.arXiv preprint arXiv:2506.09853","venue":null,"work_id":"2fea8c3e-dc49-426e-acc4-61730f47f0fa","year":2025},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:3d66902eb93ab8a978190bee15033a807072ef0317278a5d0675521832c0e137","observation_id":"4bfac326-889d-4563-9b0b-173eae26fa70","resolution":{"observed_at":"2026-05-11T11:16:05.529245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d784c78-6231-4660-963d-6c4505d087b6","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:0c129285ce00f9b4a79fdc0a93fd94f9ae9bea41f956673fce745645bde26921","observation_id":"f9e0c800-4707-4ac5-a6da-af9adc35077e","resolution":{"observed_at":"2026-05-18T08:52:31.397042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07171","last_updated":"2023-07-14T05:40:24Z","snapshot_observed_at":"2026-07-06T15:53:57.519425Z","submitted_at":"2023-07-14T05:40:24Z","title":"Certified Robustness for Large Language Models with Self-Denoising","version":1},"cited_work":{"arxiv_id":"2307.07171","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.07171","snapshot_observed_at":"2026-07-02T21:07:23.503764Z","title":"Certified robustness for large language models with self-denoising","venue":null,"work_id":"4cf18c93-cf5c-465f-a52e-071209d9675f","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2307.07171","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:aa82c6dd2a2e298e36de3384d1208cb8ddc977900ba69bb941e515cf8a79515b","observation_id":"92f773cb-ca90-41bd-8774-a19389631a34","resolution":{"observed_at":"2026-05-11T11:16:03.848386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:33:51.113788Z","title":null,"venue":null,"work_id":"9b7ab2cd-fec5-462d-b23f-994e18ea3e15","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:c5e1ee9104948cc741a713efff34b2148dc4a6c8f01667c0bc8a77d65ad5705d","observation_id":"ae3f0414-0cc9-4f02-a7f4-1cfe9c019f5d","resolution":{"observed_at":"2026-05-18T08:52:31.407393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":"2205.10625","doi":"10.48550/arxiv.2205.10625","metadata_source":"pith","pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","venue":"cs.AI","work_id":"7e58c111-4666-4996-b5ad-1c8efd433083","year":2022},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:f3206b45ee4b6f8269d7143498618bde9f192aa846815239b4d5e93df7bff529","observation_id":"53162f3f-cae7-4c4e-88b5-6f9760e6ee24","resolution":{"observed_at":"2026-05-11T11:16:05.455629Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"56f92510-5b6a-4ebc-9bab-a767a5bd66f2","year":2024},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:573b73de2a46f72cae9a0da1b41039688659d4b42d832523970322271986cfd6","observation_id":"37dc7b24-157f-41a8-9153-89835971a4e2","resolution":{"observed_at":"2026-05-18T08:52:31.394935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.547","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Questions Training with Latent Answers for Robust Multistep Question Answering","venue":null,"work_id":"bb921183-b0d7-401c-a542-a312940f59f9","year":2023},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:8be3422e79d4c214b8217babeb76b377501d60da0c7283784b1e4e1430bc739d","observation_id":"a52956a1-10e8-4862-b9d8-ab354ef030c8","resolution":{"observed_at":"2026-05-10T15:05:31.157976Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:56:11.938856Z","title":"online\" 'onlinestring :=","venue":null,"work_id":"38c07273-5071-4bbb-b2af-067af11becc7","year":null},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:36cd80017d8ed7f0f28890fc7b9f5cc9c986bbe6cdea7dd45ad69cc8c2d38081","observation_id":"55e4ea27-4af3-4481-be92-68b50546211d","resolution":{"observed_at":"2026-05-18T08:52:31.399689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T10:56:11.963345Z","title":"write newline","venue":null,"work_id":"b6ace3ad-bd44-4a95-86ee-c7b73bd4cda2","year":null},"citing_paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-10T15:04:23.688239Z"},"links":{"citing_paper":"/paper/2604.10693"},"observation_digest":"sha256:c2bbf69726baecd5fc40170121a26752715d4d5494702175107004431982094e","observation_id":"19cd3193-29eb-4924-ab7e-a828dbf0008f","resolution":{"observed_at":"2026-05-18T08:52:31.402248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.10693","last_updated":"2026-04-20T08:48:59Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:59:13.936436Z","submitted_at":"2026-04-12T15:35:08Z","title":"FACT-E: Causality-Inspired Evaluation for Trustworthy Chain-of-Thought Reasoning"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":16,"verified_exact":36,"verified_fuzzy":2},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2604.10693."}