{"as_of":"2026-08-08T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:634cb8019ca75d9b0cf03bc961f553bd6cf84825e4c4f894bfaaecbe4c3fd489","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:04:37.575936Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:20:53.998837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20184","snapshot_observed_at":"2026-08-02T22:20:53.998837Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17229","last_updated":"2026-07-17T10:02:50Z","snapshot_observed_at":"2026-08-06T15:44:57.387623Z","submitted_at":"2026-02-19T10:19:04Z","title":"Mechanistic Interpretability of Cognitive Complexity in LLMs via Linear Probing using Bloom's Taxonomy","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T22:20:53.998837Z"},"links":{"cited_paper":"/paper/2505.20184","citing_paper":"/paper/2602.17229"},"observation_digest":"sha256:148e4e81f5232963e9f99ca0e64ce5d2df97c01cda360856608a912c89f4b318","observation_id":"13673311-eda7-400a-b9d2-8c8c39141232","resolution":{"observed_at":"2026-08-02T22:20:53.998837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20184/citation-record","integrity":"/paper/2505.20184/integrity","json":"/paper/2505.20184/citation-record.json","paper":"/paper/2505.20184"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.152486Z","title":"By analyzing which concepts are invoked, we assess the knowledge dimension activated during problem-solving and whether the LLM navigates these domains coherently","venue":null,"work_id":"d4e75476-4aa6-4b16-b10b-a9a3852224b6","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.403974Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:49061dfd53a86ad74f254ba984d6926ab6aea99a46298bddddfa6e8999e900eb","observation_id":"8a7c8880-5fd9-469d-bcb4-c7d5e50c4e4d","resolution":{"observed_at":"2026-08-07T14:04:43.254905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.955401Z","title":"Thilo Hagendorff, Sarah Fabi, and Michal Kosinski","venue":null,"work_id":"55227775-6291-4468-924f-cbd6a81777cb","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.621929Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:da07680a6a1521f1660dd98a3726f9e18942b0b6eb3e6418f69dc91f8064967c","observation_id":"0fa765ff-d851-481b-a821-0373e1944790","resolution":{"observed_at":"2026-08-07T14:04:44.055481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.740276Z","title":"Representations are critical for logical coherence and traceability in reasoning","venue":null,"work_id":"6148dcb3-637f-4628-907a-6e76951d1d79","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.570182Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:80be08f10174d043dccbf9712e870bba87d4ae696310cf6ddf127d18ae695feb","observation_id":"a4aa73a5-1796-43c5-aa1f-a76b5d6ed06c","resolution":{"observed_at":"2026-08-07T14:04:42.892838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.566730Z","title":"A model’s ability to adapt its reasoning across such variants reflects generalization ability—an essential attribute of HOT","venue":null,"work_id":"25fcde98-f856-4184-868e-8ca57ffdca64","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.638056Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:8fc340833784166b5609c69b81198622c45c20fc2ceb6f62e36dacfd48688f1f","observation_id":"2f68695c-0270-47e6-81cb-67b468eebf67","resolution":{"observed_at":"2026-08-07T14:04:42.649080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.247120Z","title":"Five Keys","venue":null,"work_id":"1bdf1020-46b3-4da2-b22b-4e3e2ea6833d","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.760718Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c828037e3014543e4d507b0d7601f1c395c55a9597c906d7e9d6ab5054f202ee","observation_id":"d9d1a54d-e351-4c68-a515-5b41cb3329af","resolution":{"observed_at":"2026-08-07T14:04:42.396321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-07T14:04:34.989895Z","title":"In 2023 IEEE International Con- ference On Artificial Intelligence Testing (AITest) , pages 169–171","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.989895Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:4059faf9c3cd70ada7d044f5b7f1b2b105823a1e3cdd385429bcb315339c2665","observation_id":"30a63fb8-e0f4-41a6-a468-e77e64a0ac3f","resolution":{"observed_at":"2026-08-07T14:04:34.989895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12491","last_updated":"2024-01-23T05:19:47Z","snapshot_observed_at":"2026-08-07T20:24:26.029336Z","submitted_at":"2024-01-23T05:19:47Z","title":"Assessing and Understanding Creativity in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12491","snapshot_observed_at":"2026-08-07T14:04:35.188891Z","title":"ArXiv, abs/2401.12491","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.188891Z"},"links":{"cited_paper":"/paper/2401.12491","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:17f6e5e0b10042e6a993d23565d1e2d58b9dc775ab932f22a24b7c8c1b2b745c","observation_id":"6f285043-ceae-4a7e-b7ac-a08237cb27f7","resolution":{"observed_at":"2026-08-07T14:04:35.188891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.329931Z","title":"Five Keys","venue":null,"work_id":"9b576f2a-b533-4ada-87a0-d5bfa40d2373","year":2019},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.274686Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:06328b171f7c9802b86c393592e010ef17c55089e3abe3bb0cc6ac526189c87b","observation_id":"eda686bc-321f-44f8-b9d2-085ef43b9912","resolution":{"observed_at":"2026-08-07T14:04:43.413353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:42.986235Z","title":"These skills serve as proxies for prior knowledge and inform whether the LLM draws upon relevant background competence","venue":null,"work_id":"44a7633f-e656-4c13-a7a3-90d51eadf1d5","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.501537Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c52603b2c1db921996ba9dfd69a3eff9fa5abbf0c22b375f477808f3c78bfdb5","observation_id":"fc6c6ce0-d87c-436f-b349-e6e86497d3cf","resolution":{"observed_at":"2026-08-07T14:04:43.061734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.855239Z","title":"You should try to understand and retrieve the specific mathematical information in it such as facts, patterns, objects, or contextual information, and decipher these meanings","venue":null,"work_id":"9fc38656-c016-4dc2-88b5-b1ad35811f92","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.856691Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:2f75e040556270f877c8030e14df1aef69d1f28a7a68e266c20938367404d543","observation_id":"bc43f647-0c80-4f11-92ad-366e129e0133","resolution":{"observed_at":"2026-08-07T14:04:42.080713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.600606Z","title":"It includes understanding and organizing information, analyzing relationships, drawing conclusions, and distinguishing nuances","venue":null,"work_id":"b3608352-2571-496a-b402-06844c453a3a","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.926296Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:dddeb3da93321d9307932df3d81a1874176845e7d22e1da0da0014de8c11ddc5","observation_id":"f80c2551-b0ae-441d-87f4-f27be7b9cd08","resolution":{"observed_at":"2026-08-07T14:04:41.709139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.368127Z","title":"These new expressions should have the same form as the given expressions in the previous generated math problem","venue":null,"work_id":"eeabd7b1-55f8-4f1d-a7e9-3fab2fac2f1e","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.991143Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:924ca7a186c4697c80a93fc00879eec690a2fdedd22ec484bd7c862f8085f545","observation_id":"632569ac-4052-4187-86a6-dc67e329e041","resolution":{"observed_at":"2026-08-07T14:04:41.478200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:41.082935Z","title":"The generated stories must be a mathematical word problem with the corresponding expressions","venue":null,"work_id":"0831139b-bd51-42cd-bdc3-208db0d5b678","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.112437Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c6f54f0ccbb4932fbb1b145967c03e2ce27c41bdd2ec000d1a55fc69ed80ac57","observation_id":"d90fac4d-e73b-47fc-bc1f-49e61c612496","resolution":{"observed_at":"2026-08-07T14:04:41.250540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.845503Z","title":"question","venue":null,"work_id":"adc75a73-f2e0-45d9-8d14-c7909802cd2c","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.212697Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:7411cf25d3891f75a75ff5a35722ced4be664e61d5d78bcc2cad2e71f81d06a9","observation_id":"4ae966b1-69d3-4983-b64b-2753e21a22c2","resolution":{"observed_at":"2026-08-07T14:04:40.942421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.619974Z","title":null,"venue":null,"work_id":"bca14182-e2a2-4fbf-978c-b0b51dc62901","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.299113Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:fb84f9b71b46f18984d63f17c8c4dc8b42b685227ffb9a9a5422e7888ca237db","observation_id":"d7221b4a-69f1-4292-9c7e-b07d16682968","resolution":{"observed_at":"2026-08-07T14:04:40.731850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.445411Z","title":null,"venue":null,"work_id":"b661dc49-62e7-4069-9a09-a04ce85b1366","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.371403Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:9ff4b7e76156b29cbf22941e2ef1d5ecaaa7ab13bfdfca33f20d6a51dbee702d","observation_id":"097e0f7a-e8c0-4aa7-8a53-1112802d3640","resolution":{"observed_at":"2026-08-07T14:04:40.516278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:40.229498Z","title":null,"venue":null,"work_id":"2deee902-5b5f-41e0-8e24-951b6d003677","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.467020Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c1ccd2c74af653060b8212a9c7efae7250334b9533637fa16f68f2092080ec91","observation_id":"e7cca71a-fa57-4018-81a1-996ea4f8a584","resolution":{"observed_at":"2026-08-07T14:04:40.346332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.986757Z","title":null,"venue":null,"work_id":"8dea3b48-16d1-4740-96d0-a841028f2fbc","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.557122Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:7710ea0a9b20dd0cfa65509d30f19e933df2f32d753bb0bc38e0d3ade38cc03d","observation_id":"71cfc3bd-c73a-4638-a83b-201870d4932c","resolution":{"observed_at":"2026-08-07T14:04:40.119981Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.787354Z","title":"ID\": null,","venue":null,"work_id":"18d55387-0297-4732-8b9f-50945c4c5a44","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.650966Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:2323d5c34cb8da1d78c219652be9a79dabcd02e5d620e5e7455af663b7df5434","observation_id":"0bd16435-849c-4b77-b423-35024e0a2a0d","resolution":{"observed_at":"2026-08-07T14:04:39.859244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.597615Z","title":null,"venue":null,"work_id":"490101bf-017a-4366-9dab-eb65e6ef2c78","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.725952Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:cffc4d6b796ab52c67ba050cb94d4366614df35dc702a61c8dd67b214d5e94d4","observation_id":"905ea987-80e9-4efc-ac45-90783e9ccf18","resolution":{"observed_at":"2026-08-07T14:04:39.683488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.332629Z","title":null,"venue":null,"work_id":"8897e06b-d20e-465e-9f3c-14f4fd403aff","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.802182Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:33d4236c484585160f47db1958eba80db149c0b9e9e2efaea04d6e101a92c3d3","observation_id":"373900a1-c4ed-414f-acab-352e4fb4840a","resolution":{"observed_at":"2026-08-07T14:04:39.422480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:39.143432Z","title":null,"venue":null,"work_id":"52a315ff-f123-4b73-b5f1-41154f9882d2","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.871190Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c178782ca435d684f7bf78a3a095272f9f230d7c68bc712247464c9dad50c716","observation_id":"28bbc1f8-ccd1-4e0f-a597-8346676859cb","resolution":{"observed_at":"2026-08-07T14:04:39.228336Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.925453Z","title":null,"venue":null,"work_id":"e3af36c1-56ba-4f10-b155-f580b3a6b6d1","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:36.981345Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:fb6d8b5c027bfc866b7b914664d82608bbc858150d107765cce6d4702f4ff316","observation_id":"79f727b5-a1b4-4900-b207-266a76810f5d","resolution":{"observed_at":"2026-08-07T14:04:39.013489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.709767Z","title":null,"venue":null,"work_id":"a2750143-0a60-4bd1-be8a-38dbf154289d","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.076085Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:9160324b04a1e9e176b76e77813721059b31b4d213dc00b36f334842f62d8d4a","observation_id":"fba5fb64-1ef4-447e-8f46-3851e00a2fc2","resolution":{"observed_at":"2026-08-07T14:04:38.843275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.529042Z","title":null,"venue":null,"work_id":"a63b9988-354c-417b-8942-ff371f663239","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.196578Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:d404e430ac51dc36a6262aa7d9f3abac968224c11f10399e306bae934cc55f08","observation_id":"daaf974f-20f5-4e54-9b92-d6d3073a526b","resolution":{"observed_at":"2026-08-07T14:04:38.604568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.334207Z","title":null,"venue":null,"work_id":"6e11bc67-c9a0-4cef-81cc-a0ec6255bf68","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.286441Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:908c667b57b621cd07e8c524fcd2d69ff891da7fefa412fd98d357579e4d8008","observation_id":"88110793-a66b-414c-aaa9-dd9f02d9fef1","resolution":{"observed_at":"2026-08-07T14:04:38.445619Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:38.113814Z","title":null,"venue":null,"work_id":"98c71ab2-add9-417a-94b1-d87a74c348c0","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.367133Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:c61b56dd2c4d2d8394636945265d58c7838d09b048779306f1128fde45a2ed54","observation_id":"acfc7e07-2c28-4479-9c14-bb5374b74b76","resolution":{"observed_at":"2026-08-07T14:04:38.191305Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:37.895604Z","title":null,"venue":null,"work_id":"364b143c-c108-4e11-b950-5f3b290e6a30","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.458862Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:6745ba4e31b032e00b0abf94aed45a78f31b25c735226cae7333b74fa1707074","observation_id":"237518b0-cf69-410d-8cfa-93d6a34f5c0c","resolution":{"observed_at":"2026-08-07T14:04:38.000547Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:37.749318Z","title":"performance_score","venue":null,"work_id":"d0a755ae-c5ef-4a9e-9a63-6b7671550e61","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:37.575936Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:55a63e94e4dae9b21d8d7f795072539b2c6f13530a0c6cf576a33ae828ef9059","observation_id":"7735d87f-a2ae-410b-84eb-b1424ad23de3","resolution":{"observed_at":"2026-08-07T14:04:37.798360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.503844Z","title":"English language teaching, 3(4):237– 248","venue":null,"work_id":"66593c45-1134-43b1-a3bf-ec07696569a1","year":null},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.885086Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:d6aaa7d45b52a8a94eca17397afcf55fd66e79bd018f978089bc4db84a9ae212","observation_id":"6e3bc5a6-54ea-4d38-a129-9d44eba41060","resolution":{"observed_at":"2026-08-07T14:04:43.595243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01116","last_updated":"2024-03-02T07:49:57Z","snapshot_observed_at":"2026-08-02T18:22:56.733681Z","submitted_at":"2024-03-02T07:49:57Z","title":"MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01116","snapshot_observed_at":"2026-08-07T14:04:35.106825Z","title":"Inter- national journal of social sciences and humanities, 2(1):24–32","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:35.106825Z"},"links":{"cited_paper":"/paper/2403.01116","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:5a3149c0bd3a18866920629ad4453c7dcea72126626f3edde8b691a85c164a7b","observation_id":"4f4a0605-e26a-479d-bef5-6bda3f3c3127","resolution":{"observed_at":"2026-08-07T14:04:35.106825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16755","last_updated":"2023-10-25T16:41:15Z","snapshot_observed_at":"2026-07-06T16:38:25.599664Z","submitted_at":"2023-10-25T16:41:15Z","title":"HI-TOM: A Benchmark for Evaluating Higher-Order Theory of Mind Reasoning in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16755","snapshot_observed_at":"2026-08-07T14:04:34.719074Z","title":"Nature Computational Science, 3(10):833–838","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.719074Z"},"links":{"cited_paper":"/paper/2310.16755","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:41558339b954b416c8bacbd29f558c824b05d59eed27e3dc1cedc477a5f8939c","observation_id":"93bfd8cb-0986-4884-9228-76953960d739","resolution":{"observed_at":"2026-08-07T14:04:34.719074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:04:43.737006Z","title":"TOFEDU: The Future of Education Journal, 3(5):1488–1499","venue":null,"work_id":"6a9ec738-9d1f-42a7-ba91-18fc06323fe5","year":2018},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.807017Z"},"links":{"citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:25e948020d0a1747af13ec3b09bcc926d9f92a55713e51c3f15c73c2b5aa0f9c","observation_id":"b6c0dea8-bcd4-4dcd-8b03-81fbd12f337b","resolution":{"observed_at":"2026-08-07T14:04:43.817646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.05718","last_updated":"2022-05-11T18:14:33Z","snapshot_observed_at":"2026-07-06T13:09:03.269759Z","submitted_at":"2022-05-11T18:14:33Z","title":"Structured, flexible, and robust: benchmarking and improving large language models towards more human-like behavior in out-of-distribution reasoning tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.05718","snapshot_observed_at":"2026-08-07T14:04:34.565123Z","title":"In Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems, pages 1–23","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:04:34.565123Z"},"links":{"cited_paper":"/paper/2205.05718","citing_paper":"/paper/2505.20184"},"observation_digest":"sha256:95da776605c9e54d209879d152481afa00a8556c655b7a54e79f62eeb2082a7e","observation_id":"e335ab1c-82d5-46d0-9b99-a5dfdcb741e1","resolution":{"observed_at":"2026-08-07T14:04:34.565123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20184","last_updated":"2025-05-26T16:27:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:55:29.357199Z","submitted_at":"2025-05-26T16:27:02Z","title":"THiNK: Can Large Language Models Think-aloud?"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":3,"unresolved":15,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.20184."}