{"as_of":"2026-08-08T08:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f52286e1e02ea4264700ed89a7b19521c4425d364e1f01862c3f1693a072d34","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:47:30.778992Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20993/citation-record","integrity":"/paper/2505.20993/integrity","json":"/paper/2505.20993/citation-record.json","paper":"/paper/2505.20993"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-04T15:34:23.322583Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-08-07T13:47:24.624633Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction.arXiv preprint arXiv:2309.14316, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.624633Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c5ba0d60fdd66366f14921908c3d8b6c9a39252743472a0993d245333d917380","observation_id":"77669f41-c167-40fb-88cb-742e12c3eb62","resolution":{"observed_at":"2026-08-07T13:47:24.624633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14402","last_updated":"2024-07-16T10:33:12Z","snapshot_observed_at":"2026-08-07T23:54:23.509475Z","submitted_at":"2023-09-25T17:50:41Z","title":"Physics of Language Models: Part 3.2, Knowledge Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14402","snapshot_observed_at":"2026-08-07T13:47:24.678987Z","title":"Physics of language models: Part 3.2, knowledge manipula- tion.arXiv preprint arXiv:2309.14402, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.678987Z"},"links":{"cited_paper":"/paper/2309.14402","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:359637f0957ebb34b5045603ed959a471f973c156f8f19a55cad87a7b55376f8","observation_id":"55e856c7-db6e-4c6f-a896-1412ca79a6e5","resolution":{"observed_at":"2026-08-07T13:47:24.678987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05405","last_updated":"2024-04-08T11:11:31Z","snapshot_observed_at":"2026-08-05T03:30:28.158531Z","submitted_at":"2024-04-08T11:11:31Z","title":"Physics of Language Models: Part 3.3, Knowledge Capacity Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05405","snapshot_observed_at":"2026-08-07T13:47:24.755626Z","title":"Physics of language models: Part 3.3, knowledge capacity scaling laws.arXiv preprint arXiv:2404.05405, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.755626Z"},"links":{"cited_paper":"/paper/2404.05405","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c7fe05d796e33154acd6e2e554958ae207b7bc6b569d568dc8f66758ec7fb30b","observation_id":"6f112d02-2bfd-4ede-9044-a566f22c6636","resolution":{"observed_at":"2026-08-07T13:47:24.755626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T13:47:24.855390Z","title":"Layer normalization.arXiv preprint arXiv:1607.06450, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.855390Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:788b59748a14f3e3f30c6c912781f5e2b3ea0866f0402eb8dc66c6a30b78f5b3","observation_id":"16afb019-3eed-4473-8272-41ca8b68d353","resolution":{"observed_at":"2026-08-07T13:47:24.855390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T13:47:24.912754Z","title":"Qwen technical report.arXiv preprint arXiv:2309.16609, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:24.912754Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c1c32d1d0aeeb1fc430e401d6b84e68dbe77abd3bd19b49d2c4f962e01cb2196","observation_id":"23b2176d-4e82-425e-b8f6-2866d3ff9d2b","resolution":{"observed_at":"2026-08-07T13:47:24.912754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:25.069604Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.069604Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d5ec5ba973b04235549c433b760ee959b69398da0a4c7acddd164a305a96268f","observation_id":"0e78677b-d749-4156-97ad-df0e180273ac","resolution":{"observed_at":"2026-08-07T13:47:25.069604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-07T13:47:25.192447Z","title":"Palm: Scaling language modeling with pathways.arXiv preprint arXiv:2204.02311, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.192447Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:885a56ee96080bedd46f89394c46e9a4f478eab00b3da6ca515cfb39de97d403","observation_id":"f956631e-ccf7-4c9e-b442-8946d512c008","resolution":{"observed_at":"2026-08-07T13:47:25.192447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:32.038205Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":"a596f4d2-2b50-479f-891b-5a7e8162c807","year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.355526Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:6237ae6356eff72d058bb0acb144c3f23bc7c01b52852754a44bed35b75fd1ab","observation_id":"3b07cbc9-2fe7-4eb5-bd37-4acc7e6ba60d","resolution":{"observed_at":"2026-08-07T13:47:32.118884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-07T13:47:25.493364Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.493364Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d8e86ebf1408db610ea421026af3bec40c401a2e8154b24828adb22edb85b67d","observation_id":"76a9c62a-db9e-42db-9c6c-268e6b526357","resolution":{"observed_at":"2026-08-07T13:47:25.493364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:25.663234Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.663234Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d23d44d364eb842e49923c4a81827ba8ec18c36bbde779772bd27b9ab3cf6f36","observation_id":"538f4554-f4af-4177-9424-1cfb588c36d4","resolution":{"observed_at":"2026-08-07T13:47:25.663234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T13:47:25.795656Z","title":"Transformer feed-forward layers are key-value memories.arXiv preprint arXiv:2012.14913, 2021","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.795656Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:661ff9a49ebf1bd50e91f242a4597b26dd8b999e440aec24fe5cb74c0ec99145","observation_id":"35203ada-1183-40bf-bb23-db69617bd102","resolution":{"observed_at":"2026-08-07T13:47:25.795656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:47:25.908214Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:25.908214Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:149d78d5bd26de5fe2b95b7f33795215fdcb06be2c4807b83926a819ca4799af","observation_id":"57d631bd-940d-4bb4-a26d-94866e5818a6","resolution":{"observed_at":"2026-08-07T13:47:25.908214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:47:26.007593Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.007593Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:e1970aca5360565220f80c0972e1dd597ca5662804e5c716ecd7e6253d74695d","observation_id":"c7ec514e-d42c-4b3e-b9e6-ab71b275919e","resolution":{"observed_at":"2026-08-07T13:47:26.007593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-07T13:47:26.097333Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence.arXiv preprint arXiv:2401.14196, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.097333Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:51fb8d94afbee9073ccba27c39a41240dd8ab66e982a6a4e737ba06d3e330c5e","observation_id":"6526c668-c881-48fa-8a4f-e764fa798f23","resolution":{"observed_at":"2026-08-07T13:47:26.097333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:26.164284Z","title":"A structural probe for finding syntax in word representations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.164284Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c7392a3ad9283a447cdc9fb7748756a8e43f3c3e40b7d81f52f3d12cf2763e21","observation_id":"d57bea06-c005-4779-8f3f-6f73cb935acf","resolution":{"observed_at":"2026-08-07T13:47:26.164284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.865593Z","title":"Transformer quality in linear time","venue":null,"work_id":"d68aa6e3-f054-42a1-8af8-8bb0a2a1ff66","year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.248397Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:acd0719ce99a1024c165104ff0b11634ea0417ca09b339dd72f1c42f12c0b4fe","observation_id":"a6b67b36-161a-4aa8-9b42-736a8be2d767","resolution":{"observed_at":"2026-08-07T13:47:31.943650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T13:47:26.344745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.344745Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:36aa19556757f882b314cf3bcf8ac799364d6f4d23fc2c43568c425237d4f5df","observation_id":"9404bb06-8c59-4963-a31b-5bede295ce9d","resolution":{"observed_at":"2026-08-07T13:47:26.344745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T13:47:26.450679Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.450679Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:fb9308cf545328d0b4b3b276058780bdc6dc0088254e33232c8905e961761154","observation_id":"a92aa6b2-df33-4a1f-a0a6-14bed57ae34d","resolution":{"observed_at":"2026-08-07T13:47:26.450679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.685348Z","title":"Aime 2024 dataset","venue":null,"work_id":"9e59cf0b-3ec4-4e02-b2bf-7fc3c17c9aa6","year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.641950Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:f2b9e22bd06aebe6755c28014840621258af40eefc8e835ba95903c491be39fe","observation_id":"46473601-accf-49e8-8151-3b11b46f4197","resolution":{"observed_at":"2026-08-07T13:47:31.781356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:26.791888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.791888Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:33f295b7d246c8d888405a7ed7f192c45a7e238f456f5df9ffa1f1e772b0ad37","observation_id":"c7873328-d311-4e15-93de-13dcae1fbd32","resolution":{"observed_at":"2026-08-07T13:47:26.791888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T13:47:26.914583Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:26.914583Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a4998bccaaa2de37a905696fc4d51aa6d42010e4f4f194cffd363131f039e9f2","observation_id":"a08b6bea-a8e2-4b2f-a94c-8b9f16c56159","resolution":{"observed_at":"2026-08-07T13:47:26.914583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.072927Z","title":"Natural questions: a benchmark for question answering research.Transactions of the Association for Computational Linguistics, 7:453–466, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.072927Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:d12f4b5180209770097737c708d02f4c45269b6f74217989f150c343e8f76304","observation_id":"d744b9d3-7208-4b3a-b03e-6c69eddc6a02","resolution":{"observed_at":"2026-08-07T13:47:27.072927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.243545Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.243545Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:45282a1a59230bc59ff78dc7b95c19e88d6c85429700bb4ab7fda339b2b28c8f","observation_id":"05eebde5-217a-4e5a-a942-1a43d401d6b0","resolution":{"observed_at":"2026-08-07T13:47:27.243545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:27.357354Z","title":"Locating and editing factual associations in gpt.Advances in neural information processing systems, 35:17359–17372, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.357354Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:6629eb96fb41c29635d79b91d34920b1b7967e6541c777e8602785343a75bfac","observation_id":"790bb079-e538-4293-abbb-8c2952537878","resolution":{"observed_at":"2026-08-07T13:47:27.357354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T13:47:27.471116Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.471116Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:b2c0811502501d39b2acbe20fff7b54d7a10a0f748f845e685169e4a2071577d","observation_id":"1d462011-07bb-4801-85eb-52ea02e07e5b","resolution":{"observed_at":"2026-08-07T13:47:27.471116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.06023","last_updated":"2016-08-26T16:13:13Z","snapshot_observed_at":"2026-07-30T19:30:50.474373Z","submitted_at":"2016-02-19T02:04:18Z","title":"Abstractive Text Summarization Using Sequence-to-Sequence RNNs and Beyond","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.06023","snapshot_observed_at":"2026-08-07T13:47:27.605528Z","title":"Abstractive text sum- marization using sequence-to-sequence rnns and beyond.arXiv preprint arXiv:1602.06023, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.605528Z"},"links":{"cited_paper":"/paper/1602.06023","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:554fb0f465e390d5e32bb0bcb7ba172d8c7db1cf47f662bdca6286d21d3866f7","observation_id":"f278091a-edae-4c81-9c8c-a70845b48c9d","resolution":{"observed_at":"2026-08-07T13:47:27.605528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.08745","last_updated":"2018-08-27T09:08:18Z","snapshot_observed_at":"2026-07-06T06:57:36.335954Z","submitted_at":"2018-08-27T09:08:18Z","title":"Don't Give Me the Details, Just the Summary! Topic-Aware Convolutional Neural Networks for Extreme Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.08745","snapshot_observed_at":"2026-08-07T13:47:27.756683Z","title":"Don’t give me the details, just the summary! topic-aware convolutional neural networks for extreme summarization.arXiv preprint arXiv:1808.08745, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.756683Z"},"links":{"cited_paper":"/paper/1808.08745","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:fe1a6993003c5c1f753cfefaecd6cb3fb4cd26f6467670f7db4f14ed0c110c04","observation_id":"487c46fb-91ac-4517-9ce8-93468f423a98","resolution":{"observed_at":"2026-08-07T13:47:27.756683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-07T13:47:27.901823Z","title":"Training language models to follow instructions with human feedback.arXiv preprint arXiv:2203.02155, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:27.901823Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:94bd650dcc97732e0bcaacbe20a9f08afae03b4cb22a9c742bd52f1a4e77f2da","observation_id":"772acc8d-e0ed-4740-bcd4-15973c10a3b2","resolution":{"observed_at":"2026-08-07T13:47:27.901823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.088761Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.088761Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a6ff934d605edee6f9a6cc98d513de9a24b2db909e520a21f07f43ef472b071d","observation_id":"1615f6ce-752d-44ea-8092-719a5b7cefb2","resolution":{"observed_at":"2026-08-07T13:47:28.088761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.202466Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.202466Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:6659b4882dbf2e35f35ec2e619210b1ae34134af7962622c85e29fa6c361d4a3","observation_id":"6513d4a9-7b40-4753-9048-81b292eab7d7","resolution":{"observed_at":"2026-08-07T13:47:28.202466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.279472Z","title":"Zero: Memory optimiza- tions toward training trillion parameter models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.279472Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:11cdeaacd32bfebd169c76f2c9d8a574a7b0e763acb229d47de048f34bb65977","observation_id":"1d9c83d3-0b94-45f9-9752-da730b22d677","resolution":{"observed_at":"2026-08-07T13:47:28.279472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-07T13:47:28.396444Z","title":"Squad: 100,000+ questions for machine comprehension of text.arXiv preprint arXiv:1606.05250, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.396444Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:69238b4f6cd56de0078c134d2adddd53a1b6a05e46c9029252fb2892d04aedae","observation_id":"23bbd5ee-539a-4574-9273-afced8c71bbb","resolution":{"observed_at":"2026-08-07T13:47:28.396444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.464962Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.464962Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:2c75f408d8c8b4017839f31b92cd6f72a084e05d4bc1e087e2e30789a919be62","observation_id":"d96b7ba3-347b-417b-9acc-d4c29d5687d2","resolution":{"observed_at":"2026-08-07T13:47:28.464962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03002","last_updated":"2023-12-03T20:53:41Z","snapshot_observed_at":"2026-08-06T06:54:08.200537Z","submitted_at":"2023-12-03T20:53:41Z","title":"The mechanistic basis of data dependence and abrupt learning in an in-context classification task","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03002","snapshot_observed_at":"2026-08-07T13:47:28.549745Z","title":"The mechanistic basis of data dependence and abrupt learning in an in-context classification task.arXiv preprint arXiv:2312.03002, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.549745Z"},"links":{"cited_paper":"/paper/2312.03002","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c1f9119e240adcb26fac837ec27f647a375b1c7fb92e1b3e5f2fa591a0432bbc","observation_id":"950eddb8-c341-4a38-8a4e-0a214ddec4b5","resolution":{"observed_at":"2026-08-07T13:47:28.549745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-07T13:47:28.633238Z","title":"Tool- former: Language models can teach themselves to use tools.arXiv preprint arXiv:2302.04761, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.633238Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:599608791604c4ff56be09085b75a6aa540f1a1b2e7f7a1842335eea313b2a7d","observation_id":"db5fb179-7aad-4d40-bd83-0590fa768dc7","resolution":{"observed_at":"2026-08-07T13:47:28.633238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:47:28.708526Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.708526Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c60ac369d9f1e93098dd2dd6dbbabc3f6e707a228621630ca06cc646949e7e6e","observation_id":"b32b02d2-68c3-4fc3-ba5b-cb681d4b3e85","resolution":{"observed_at":"2026-08-07T13:47:28.708526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T13:47:28.800385Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.800385Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ca532ccbcfdf001b5e8a6a58f677c6bed440f82ccbde47b69f603fadf1f4a5c5","observation_id":"ea66fc28-bf33-4d36-b9a2-a785ebb4e587","resolution":{"observed_at":"2026-08-07T13:47:28.800385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:28.927468Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:28.927468Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:b2f1f6ae790e46926117353c651a3c0ecd0ab820e790fdf35a07aa564d3278d0","observation_id":"625ec01b-3389-4c84-aec7-3e07aa2fabee","resolution":{"observed_at":"2026-08-07T13:47:28.927468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-07T13:47:29.015912Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.015912Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:bb75c3e6cc60fecb7d2aa5bb99baaf450acf5c49caec500339d541bfe35aa6d3","observation_id":"d5713037-a29d-423c-bf5b-d68e5a559267","resolution":{"observed_at":"2026-08-07T13:47:29.015912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:29.122167Z","title":"QwQ-32B: Embracing the Power of Reinforcement Learning, March 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.122167Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:f598775d6a7bb3a88bc2880559ed4f415cd2d4265b58fd55672311bf27e81fd6","observation_id":"a915bc97-4c15-4a4c-a220-53e14de63428","resolution":{"observed_at":"2026-08-07T13:47:29.122167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:47:29.253806Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.253806Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:9867dd9a271cbd16a53b31515197a3cedd5e68cb8c406e3485642a06d542aeb7","observation_id":"9c98f776-9920-4f11-9b0e-09fda579b3c4","resolution":{"observed_at":"2026-08-07T13:47:29.253806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:47:29.347634Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.347634Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:c2713835d1948c74aba5dfaaa266b2ae093d42c64c554513b9ae795955adcd3f","observation_id":"aaf4adad-0b7f-4e3b-b0a4-94f6abcd97d3","resolution":{"observed_at":"2026-08-07T13:47:29.347634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:29.454118Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.454118Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:bc2182f28fc7e3a98001c2220fe4322412dd0915ca0aec709fe80c4b4c7c5033","observation_id":"abb096ab-1dc4-4289-bdc9-9be6b47cd701","resolution":{"observed_at":"2026-08-07T13:47:29.454118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04284","last_updated":"2019-06-18T19:42:31Z","snapshot_observed_at":"2026-07-06T07:59:23.899551Z","submitted_at":"2019-06-07T13:58:49Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04284","snapshot_observed_at":"2026-08-07T13:47:29.564033Z","title":"Analyzing the structure of attention in a transformer language model.arXiv preprint arXiv:1906.04284, 2019","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.564033Z"},"links":{"cited_paper":"/paper/1906.04284","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:98ab09d0653b9026e74c9acebd625bb7103336a30255389a00bf50c3b873b43a","observation_id":"4469a898-7bae-4833-a8f2-9177657715f0","resolution":{"observed_at":"2026-08-07T13:47:29.564033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T13:47:29.685237Z","title":"Self-consistency improves chain of thought reasoning in language models.arXiv preprint arXiv:2203.11171, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.685237Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:f3e8fae33c0f20d6abb0a01c454df08561e6c0ad2dbc60e42ad1e4d30783762f","observation_id":"fa770ff0-fdef-4baa-a2c8-f076ce87e907","resolution":{"observed_at":"2026-08-07T13:47:29.685237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-07T13:47:29.756977Z","title":"Self-instruct: Aligning language models with self-generated instruc- tions.arXiv preprint arXiv:2212.10560, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.756977Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:b69802942ac8c6f9a39b02f9ea9a6fc0e4a3e81e857b51f363bd617df39a1f3d","observation_id":"aeef9f74-6ff1-4123-b262-84ce4547d92d","resolution":{"observed_at":"2026-08-07T13:47:29.756977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T13:47:29.827906Z","title":"Emergent abilities of large language models.arXiv preprint arXiv:2206.07682, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.827906Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:a614e184cacfe28d0ae537cf525f844af0265daac78dc9128f3ded2b83febbb0","observation_id":"579ce010-cb2f-4bf5-9f5b-89d4cda66837","resolution":{"observed_at":"2026-08-07T13:47:29.827906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T13:47:29.952370Z","title":"Chain-of-thought prompting elicits reasoning in large language models.arXiv preprint arXiv:2201.11903, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:29.952370Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:5cdfc6b0706e41cfa7cfee0db5ef141fae152bbfe70825789bdc5e6c34558fee","observation_id":"a48acdd5-5b4d-457d-875d-800835a61bce","resolution":{"observed_at":"2026-08-07T13:47:29.952370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:31.377884Z","title":null,"venue":null,"work_id":"286504f0-43f9-4a01-98a9-3b79af896479","year":2020},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.021371Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:224e69318a7c7de1591a45eee252ad20569be6eeb48602165f5fae69f789f0b6","observation_id":"a7a1e557-55b2-4048-addc-15e258a0e983","resolution":{"observed_at":"2026-08-07T13:47:31.504773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-07T13:47:30.111332Z","title":"Google’s neural machine translation system: Bridging the gap between human and machine translation.arXiv preprint arXiv:1609.08144, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.111332Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:9e3f32b98015fe7ea94bcf96fa67383419fd10778ada68eed7aafffe8d4fca23","observation_id":"3bf64778-3d8a-4aa9-bb19-0ef691507091","resolution":{"observed_at":"2026-08-07T13:47:30.111332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:30.199921Z","title":"Qwen3 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.199921Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:0b9bc65b71e8ae0624dea1a7c87092509e3f5d8206f0716fe9400a620fe6d408","observation_id":"672aecf7-59f0-4c11-9d0e-c9384872401d","resolution":{"observed_at":"2026-08-07T13:47:30.199921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:47:30.385722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.385722Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:8ceb54de753c6b5a4b6ba7fd6fd06dd684c1532f3b9da7e7d36889867d10b016","observation_id":"af7e55bc-a736-48fe-a1a0-4f91129163dd","resolution":{"observed_at":"2026-08-07T13:47:30.385722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T13:47:30.494845Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.494845Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:1b13b85dfec473f91c21bcd31d6242725d1056faa6e9a309c767f6ae709640b4","observation_id":"179123ed-0508-40c4-be52-42873490cf41","resolution":{"observed_at":"2026-08-07T13:47:30.494845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:47:30.644570Z","title":"Simplerl-zoo: Investigating and taming zero reinforcement learning for open base models in the wild, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.644570Z"},"links":{"citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:ee70638ce1dfe189fde8a6091b80ca778295fdbc9c9a4c95c061d77bdef6c3c3","observation_id":"72f78c0d-a16e-4278-b6c2-547478ded6a5","resolution":{"observed_at":"2026-08-07T13:47:30.644570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10625","last_updated":"2023-04-16T22:08:08Z","snapshot_observed_at":"2026-08-06T09:00:42.886249Z","submitted_at":"2022-05-21T15:34:53Z","title":"Least-to-Most Prompting Enables Complex Reasoning in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.10625","snapshot_observed_at":"2026-08-07T13:47:30.778992Z","title":"Least-to-most prompting enables complex reasoning in large language models.arXiv preprint arXiv:2205.10625, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:47:30.778992Z"},"links":{"cited_paper":"/paper/2205.10625","citing_paper":"/paper/2505.20993"},"observation_digest":"sha256:f1115ef54bdfe8cd89f2181b6f455ee835b09ae767a131562519f427b088668d","observation_id":"6a200537-80a8-422b-84fc-27bfe6553f86","resolution":{"observed_at":"2026-08-07T13:47:30.778992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20993","last_updated":"2025-05-27T10:26:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:55:50.756740Z","submitted_at":"2025-05-27T10:26:47Z","title":"Who Reasons in the Large Language Models?"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":52,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 0 inbound Pith citation observations for arXiv:2505.20993."}