{"as_of":"2026-08-07T23:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6056bfcfd29286792b6a07ad8f54eb3f2e8cb129e7716a2db07b925ca1b593bb","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:57:58.531823Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04646/citation-record","integrity":"/paper/2608.04646/integrity","json":"/paper/2608.04646/citation-record.json","paper":"/paper/2608.04646"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0010-0277(85","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.284983Z","title":"theory of mind","venue":null,"work_id":"c0ae8cdb-8d57-4ce4-9e0d-d926fa09744f","year":null},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.755499Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:2531aa0bcfdba7f430d02ce3ab61af55b42c7b2838b35a27675f921d72e99ff1","observation_id":"3a998c75-ba30-475b-9bbe-ab8b4ef2870a","resolution":{"observed_at":"2026-08-06T19:57:59.325414Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.419620Z","title":"In: International review of research in mental retardation: Autism (vol","venue":null,"work_id":"f8c4b234-ad03-4f3a-b211-c4b4912dddaf","year":2001},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.825151Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:1005ad610eda94bd839f1f124d8b660331a1f572f184ab719ff9aa02fc0c0024","observation_id":"8586bd55-c918-4eb9-81a4-8132ea053367","resolution":{"observed_at":"2026-08-06T19:58:00.460670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-06T19:57:55.904927Z","title":"https://doi.org/10.48550/arXiv.2505.05410, arXiv:2505.05410 [cs] 14 I.B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.904927Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:5fcf03382d7f3b0e24995e3bc152aa0d23ae196e7f7ec872cabc38d75470f605","observation_id":"6d18e975-e46c-44ff-85d0-654d64217051","resolution":{"observed_at":"2026-08-06T19:57:55.904927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:55.979951Z","title":"In: Ku, L.W., Martins, A., Srikumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:55.979951Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:038c4b197ccec17d785188e46a9177922585b82f60c49953aa9bc628be31149d","observation_id":"2a904c98-c946-4951-bf12-48ed214c3806","resolution":{"observed_at":"2026-08-06T19:57:55.979951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.053707Z","title":"In: Bouamor, H., Pino, J., Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.053707Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:5772b799aded78daaf1e753ebad5d906e3b9dcf13b0a519ef0f3f52ac706925e","observation_id":"a4fed512-fd53-4620-be3a-2d1c1f65f55b","resolution":{"observed_at":"2026-08-06T19:57:56.053707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.212467Z","title":"children aged 7-10 on advanced tests","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.212467Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:354303b52a082a009aadea04ce7f882ad0add277bc056c1bc872ca69e28f4943","observation_id":"b6347d50-eb3d-4305-b10b-802e39a29343","resolution":{"observed_at":"2026-08-06T19:57:56.212467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.317940Z","title":"Nature645(8081), 633–638 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.317940Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:e17cacdab7f773ed58ad04eb36dd8ab97b69cfebbc673c4405cd8818e7ba1d65","observation_id":"a5901f2b-78e4-472a-b221-145ab6be942a","resolution":{"observed_at":"2026-08-06T19:57:56.317940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:56.442871Z","title":"Philosophical Transactions of the Royal Society B: Biological Sciences380(1932), 20230499 (08 2025)","venue":null,"work_id":null,"year":1932},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.442871Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:2f3694c53d389352015d3d5167d2408fe1725bda62039811de221aa32f58b610","observation_id":"0a18beee-421c-4e8e-a019-dd6780a2ba2e","resolution":{"observed_at":"2026-08-06T19:57:56.442871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.300647Z","title":"In: COLM (2025)","venue":null,"work_id":"c8b93d14-3de1-463d-a14a-9571d1082dfa","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.549847Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:eb827e0034b098758b8ed268dd9811e2afc1fc9896ec0ed35d3cfc076875bbcc","observation_id":"878fb98d-b2e9-425d-aa69-de4df47a3689","resolution":{"observed_at":"2026-08-06T19:58:00.360383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15421","last_updated":"2023-10-31T17:58:30Z","snapshot_observed_at":"2026-08-06T22:17:55.289636Z","submitted_at":"2023-10-24T00:24:11Z","title":"FANToM: A Benchmark for Stress-testing Machine Theory of Mind in Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15421","snapshot_observed_at":"2026-08-06T19:57:56.664963Z","title":"https://doi.org/10.48550/arXiv.2310.15421, arXiv:2310.15421 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.664963Z"},"links":{"cited_paper":"/paper/2310.15421","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:998d62827c29e3f11b524e68e73a96fddcb3ca98cf25809db8e491f6aaec8f3a","observation_id":"8db2ee0f-190a-4eb2-85eb-4c69f7fed3cc","resolution":{"observed_at":"2026-08-06T19:57:56.664963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02083","last_updated":"2024-11-04T19:51:53Z","snapshot_observed_at":"2026-08-07T09:50:45.770227Z","submitted_at":"2023-02-04T03:50:01Z","title":"Evaluating Large Language Models in Theory of Mind Tasks","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02083","snapshot_observed_at":"2026-08-06T19:57:56.756766Z","title":"Pro- ceedings of the National Academy of Sciences121(45), e2405460121 (Nov 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.756766Z"},"links":{"cited_paper":"/paper/2302.02083","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:ea67423bbd733dcbf0afe722a708f89568a8dd9695c06326eb224f4860eb10db","observation_id":"74b814d5-e1b2-4821-8e66-d3fecded039f","resolution":{"observed_at":"2026-08-06T19:57:56.756766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:58:00.132653Z","title":"In: Carl- son,L.A.,Hölscher,C.,Shipley,T.F.(eds.)Proceedingsofthe33thAnnualMeeting of the Cognitive Science Society, CogSci 2011, Boston, Massachusetts, USA, July 20-23, 2011","venue":null,"work_id":"ec20d777-2174-4017-be41-5e432f4ba3ea","year":2011},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.828121Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:845a013c779540152e5d691f026a754e7bf9c305a84d6cfbab7bb1ea4980ee5a","observation_id":"3d70ad9f-2297-4d9b-a8e5-8f820b4a3267","resolution":{"observed_at":"2026-08-06T19:58:00.236442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16468","last_updated":"2025-02-28T19:12:35Z","snapshot_observed_at":"2026-08-07T17:38:32.206554Z","submitted_at":"2025-02-28T19:12:35Z","title":"Towards properly implementing Theory of Mind in AI systems: An account of four misconceptions","version":1},"cited_work":{"arxiv_id":"2503.16468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.16468","snapshot_observed_at":"2026-08-06T19:57:59.675056Z","title":"Towards properly implementing Theory of Mind in AI systems: An account of four misconceptions","venue":"cs.HC","work_id":"12d93efb-0dda-4e7e-8b2a-431651b6bc66","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:56.922990Z"},"links":{"cited_paper":"/paper/2503.16468","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:47fddd3cbf5ae9c5e62d134a17ed5f8d0fec17fa9e13d4825b41edf7039bc2e3","observation_id":"002a0f30-4974-4556-9986-3213874b0aad","resolution":{"observed_at":"2026-08-06T19:57:59.784465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.933845Z","title":null,"venue":null,"work_id":"aaf96d93-8dc4-4185-82ad-b7aa02a45f15","year":null},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.007310Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:6a66ac109e9afc8d11b0676c7e4072e324229f5fb9a57c79187cd29c2a6081ee","observation_id":"fa6cdb68-d817-43f1-b6f1-019868e78b3f","resolution":{"observed_at":"2026-08-06T19:57:59.998996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20339","last_updated":"2025-02-27T18:08:16Z","snapshot_observed_at":"2026-08-07T17:42:05.982836Z","submitted_at":"2025-02-27T18:08:16Z","title":"Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20339","snapshot_observed_at":"2026-08-06T19:57:57.120102Z","title":"https://doi.org/10.48550/arXiv.2502.20339, arXiv:2502.20339 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.120102Z"},"links":{"cited_paper":"/paper/2502.20339","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:8a35d467b62274ade4c2c78e7193842073fbce80e9579e806b618c999bab5a50","observation_id":"144c04ea-677e-4c8d-b995-b7a531e3ebed","resolution":{"observed_at":"2026-08-06T19:57:57.120102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.252816Z","title":"Journal of Artificial Intelligence Research84(29) (Dec 2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.252816Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:cbd223e5a33c29cee6a32e67f99680e524f9ddb35dc89bd953940c129391f2d4","observation_id":"83cb6339-a9e3-4c4b-87e6-0171b20f3385","resolution":{"observed_at":"2026-08-06T19:57:57.252816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.304852Z","title":"ACM Comput","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.304852Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:eb187b0764aede5babf1036ac43d25f77b99875a9786151fdbe2d39c301e06ab","observation_id":"45993953-5fe5-45a6-b6fa-40d4f8d52dd1","resolution":{"observed_at":"2026-08-06T19:57:57.304852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/1745691619896607","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.082223Z","title":"Perspectives on Psychological Science15(2), 384–396 (Mar 2020)","venue":null,"work_id":"a94bd402-72fc-4d74-8533-a31c3446ef85","year":2020},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.412475Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:b498486c9b9dc00a572cf493c0db256cd6ebf807a2adc02a04bef239e88e995d","observation_id":"28303f7c-1c0e-4578-9090-0f53aee498e5","resolution":{"observed_at":"2026-08-06T19:57:59.153911Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.499949Z","title":"Nature568(7753), 477–486 (Apr 2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.499949Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:05de015beab188b05a0ccb960d0484ca90e832470982997af501410485cc9a11","observation_id":"cbff10c5-13e5-47a7-be4b-93b2ba694e97","resolution":{"observed_at":"2026-08-06T19:57:57.499949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/bf03395673","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:58.936029Z","title":"https://doi.org/10.1007/BF03395673","venue":null,"work_id":"c5376f02-ed9a-4125-b7f5-0a3b86132f1d","year":2009},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.570760Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:d9010311066aa65fc2be7e0e909889e3f391c9237cf7b60744a842bc52fa79f8","observation_id":"5a2f44cd-b5ba-4051-8ba4-ebe6bdbd051d","resolution":{"observed_at":"2026-08-06T19:57:59.020214Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.694518Z","title":"In: Graham, Y., Purver, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.694518Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:331f9d51945ccca9133a84ae9e3e0920115864fa7d8c0d3424c81554d64ff61f","observation_id":"5e583de9-3030-4dd0-b2c5-df20d4172eb3","resolution":{"observed_at":"2026-08-06T19:57:57.694518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.16332","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:59.487328Z","title":"Frontiers in Human Neuro- scienceV olume 19 - 2025(2026)","venue":null,"work_id":"571677ae-c6a0-48c5-b3b2-653cd664bb53","year":2026},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.790600Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:c401a675ed8a64b827473118642ca71b949a4a9a3c911c98f55068d9a4d4f700","observation_id":"4d0d79d8-22f4-4378-bf3b-cb081e84939a","resolution":{"observed_at":"2026-08-06T19:57:59.553238Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:57.878257Z","title":"MindLIX(236), 433–460 (Oct 1950)","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:57.878257Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:17da9839cbe3789b31b8d51b88ccdd3e331bb75120167b1268a8fad41c8f0f7f","observation_id":"b9e01472-e7b5-41ec-b8f9-66f60c7d83c8","resolution":{"observed_at":"2026-08-06T19:57:57.878257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08399","last_updated":"2023-03-14T13:47:26Z","snapshot_observed_at":"2026-07-06T14:52:34.482294Z","submitted_at":"2023-02-16T16:18:03Z","title":"Large Language Models Fail on Trivial Alterations to Theory-of-Mind Tasks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08399","snapshot_observed_at":"2026-08-06T19:57:58.012382Z","title":"https://doi.org/10.48550/arXiv.2302.08399, arXiv:2302.08399 [cs]","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.012382Z"},"links":{"cited_paper":"/paper/2302.08399","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:e32c2237f63c20538e984b4dbc8c974ba8e444fd63172de0ccde82b030aa19d4","observation_id":"efd59943-ef7c-46cf-a890-1f6a849ee043","resolution":{"observed_at":"2026-08-06T19:57:58.012382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:58.107602Z","title":"In: Ku, L.W., Martins, A., Srikumar, V","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.107602Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:81d0466ad9dfcb7ba4ffb54c025ef767cf2a0e2a874bb3950d8904eeae54cdc5","observation_id":"1e5b777d-7d1d-44cb-b457-a1fab35e2e4c","resolution":{"observed_at":"2026-08-06T19:57:58.107602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2505.17348","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:57:58.748348Z","title":"https://doi.org/10","venue":null,"work_id":"b8c9a104-7c7e-4ec3-a7be-7c79a3f1cc7c","year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.228998Z"},"links":{"citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:ff35b2713de7431a28467da514a3a3cfe5c5987ca7e53adb9e8f1f95b9bd0f2c","observation_id":"0f5e2818-ceae-4b9a-a7b8-52063225724d","resolution":{"observed_at":"2026-08-06T19:57:58.834524Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09686","last_updated":"2025-01-23T08:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T17:37:58Z","title":"Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09686","snapshot_observed_at":"2026-08-06T19:57:58.331596Z","title":"https://doi.org/10","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.331596Z"},"links":{"cited_paper":"/paper/2501.09686","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:e26408c3e912753aac232743c02663e02a2cec73723db9d0a2a75516f19e0bb5","observation_id":"655a45f1-0959-4cea-8acd-5a28f2ad3d8d","resolution":{"observed_at":"2026-08-06T19:57:58.331596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-06T19:57:58.429893Z","title":"https://doi.org/10.48550/arXiv.2504.13837, arXiv:2504.13837 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.429893Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:f4d5cafd243326ee4e0d9bbe7a9bcebe3d99b158261f9e974af76b4fac7d014a","observation_id":"6ad5b64e-0781-4f7e-a70f-c0cc519afad6","resolution":{"observed_at":"2026-08-06T19:57:58.429893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-06T19:57:58.531823Z","title":"https://doi.org/10.48550/arXiv.2303.18223, arXiv:2303.18223 [cs]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:57:58.531823Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2608.04646"},"observation_digest":"sha256:7494d2957c37db91d6f08aba00757660d05916ce2caa4ab0ab32efb3ed4ad7bd","observation_id":"5f23ef2c-ab01-4a65-8aba-91a6a5e24867","resolution":{"observed_at":"2026-08-06T19:57:58.531823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04646","last_updated":"2026-08-05T10:05:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T22:17:16.775309Z","submitted_at":"2026-08-05T10:05:53Z","title":"Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":5,"verified_fuzzy":3},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2608.04646."}