{"as_of":"2026-08-08T16:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a836abc3f27a2c840b287c8708941807f6b5f06d89abfd9d8693b685418bfbae","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:26:07.791076Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":18,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2402.09664","last_updated":"2026-04-07T05:36:18Z","snapshot_observed_at":"2026-07-06T17:30:25.359458Z","submitted_at":"2024-02-15T02:24:46Z","title":"CodeMind: Evaluating Large Language Models for Code Reasoning","version":6},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T03:53:55.964755Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2402.09664"},"observation_digest":"sha256:623c5f4a6f610a7bf9d0c38b28b091dcf05269d81b00a87e5e64947912434e17","observation_id":"bc2dccdf-d5c3-42fd-9e58-6dd7403b02ab","resolution":{"observed_at":"2026-05-24T03:55:59.724114Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:6c054756ce403439f3fcd83b7e08aa23fd968c91ae2b913cf70ad87c0c125774","observation_id":"62556a23-cace-46bc-8bd7-288500d2566c","resolution":{"observed_at":"2026-05-10T17:34:43.061781Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-08T15:26:07.791076Z","title":"Reasoning or reciting? ex- ploring the capabilities and limitations of language models through counterfactual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06453","last_updated":"2025-02-12T23:16:27Z","snapshot_observed_at":"2026-08-08T15:20:43.084873Z","submitted_at":"2025-02-10T13:31:46Z","title":"MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T15:26:07.791076Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2502.06453"},"observation_digest":"sha256:f844eee4136c642af5ec0c1ee9dda7bc6f3b793f5bfd82332ca52fd3af443351","observation_id":"72d5a5a4-9e23-4837-bf1d-6761112bb72a","resolution":{"observed_at":"2026-08-08T15:26:07.791076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-07T22:12:50.234654Z","title":"Reasoning or reciting? Exploring the capabilities and limitations of language models through counterfactual tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09297","last_updated":"2025-09-09T07:21:48Z","snapshot_observed_at":"2026-08-08T05:23:52.374410Z","submitted_at":"2025-02-13T13:11:54Z","title":"When Do Neural Networks Learn World Models?","version":5},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-07T22:12:50.234654Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2502.09297"},"observation_digest":"sha256:db7a6e818339f82ca7ce6c061418f15037710f4ed66d3a100d71c85dc5a9ffa8","observation_id":"7c070b59-3f4c-41e0-b02b-0124c0af69c5","resolution":{"observed_at":"2026-08-07T22:12:50.234654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-07T12:35:12.114973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24173","last_updated":"2025-05-30T03:33:25Z","snapshot_observed_at":"2026-08-07T20:54:16.475143Z","submitted_at":"2025-05-30T03:33:25Z","title":"DrVD-Bench: Do Vision-Language Models Reason Like Human Doctors in Medical Image Diagnosis?","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:35:12.114973Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2505.24173"},"observation_digest":"sha256:50aba32d983c05c6d7aa3a649af146feb62d87b10ce1a0a8204c880bb7cebe14","observation_id":"bb29bb42-4472-487b-8b80-686ea9d74086","resolution":{"observed_at":"2026-08-07T12:35:12.114973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-06T22:36:25.165193Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks.arXiv preprint arXiv:2307.02477, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.21215","last_updated":"2025-06-26T13:11:01Z","snapshot_observed_at":"2026-08-07T10:37:00.427385Z","submitted_at":"2025-06-26T13:11:01Z","title":"Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T22:36:25.165193Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2506.21215"},"observation_digest":"sha256:46201e1927b1d0f0ea227283151d978ad4c06992605457dd96395124a83b04fa","observation_id":"348c9fc5-24dc-48f0-9148-e211ba1f9b8c","resolution":{"observed_at":"2026-08-06T22:36:25.165193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2510.15079","last_updated":"2026-04-07T05:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T18:48:12Z","title":"Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T05:59:00.400429Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2510.15079"},"observation_digest":"sha256:1216d826f096dcdbe27c8ab75321665e007ac7c3dbd48f540a9f8021aad57ab4","observation_id":"0f37452d-96db-4374-a55d-dd9ebd2a7fa8","resolution":{"observed_at":"2026-05-18T06:00:57.202752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2604.13934","last_updated":"2026-04-15T14:46:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T14:46:12Z","title":"Towards Enabling An Artificial Self-Construction Software Life-cycle via Autopoietic Architectures","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-10T12:43:14.903173Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2604.13934"},"observation_digest":"sha256:8d479953278677aed2aa3f3c8a621c339231cdcfa68bb208170dfb0e646e8d01","observation_id":"934dde8a-37b4-41c8-8e43-43025358ee8d","resolution":{"observed_at":"2026-05-10T12:45:23.463395Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:a3763c2e6dd646034bc919d21c0a3f89cbcb1be631c3dcc283a210737f54b420","observation_id":"6f1e6424-c511-461c-b745-9f61eaa03f69","resolution":{"observed_at":"2026-05-11T03:50:57.407403Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.02211","last_updated":"2026-06-01T13:10:49Z","snapshot_observed_at":"2026-08-02T18:41:16.377453Z","submitted_at":"2026-06-01T13:10:49Z","title":"Consistency Training while Mitigating Obfuscation via Rate Matching","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:43.147442Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.02211"},"observation_digest":"sha256:16a12984d8437854ad0bc046d30715997e3b4a7852c97836abadb6388d6064af","observation_id":"5fa8a140-b3c5-4625-b317-12fc078b4972","resolution":{"observed_at":"2026-06-28T14:32:18.024087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:0c1b621344f29a735bb0c68efec99d699c1a54f9e2f871dbbf00f22ac4ab257b","observation_id":"6ef97197-df16-45ad-a0e0-1cd392c09bb8","resolution":{"observed_at":"2026-07-02T20:57:23.994598Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2606.29799","last_updated":"2026-06-29T05:27:09Z","snapshot_observed_at":"2026-07-07T00:03:45.783349Z","submitted_at":"2026-06-29T05:27:09Z","title":"The CRISTAL Method: Neurosymbolic analysis from AI-synthesized world models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T06:40:40.776789Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2606.29799"},"observation_digest":"sha256:ebb3ef8fd07444d833e62fca7cb34757d743784199699cfc60aa1da49fa0ce3f","observation_id":"1733969a-8cd5-4930-9094-42d7c728d6de","resolution":{"observed_at":"2026-06-30T06:44:18.978102Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks","version":3},"cited_work":{"arxiv_id":"2307.02477","doi":"10.48550/arxiv.2307.02477","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02477","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":"arXiv (Cornell University)","work_id":"fda08cc2-ac47-4359-8adf-3e30914877e2","year":2024},"citing_paper":{"arxiv_id":"2607.00276","last_updated":"2026-06-30T23:52:15Z","snapshot_observed_at":"2026-08-08T10:47:33.889635Z","submitted_at":"2026-06-30T23:52:15Z","title":"Testing Frontier Large Language Models' Physics Literacy in Parallel Physical Worlds","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-02T19:18:43.558804Z"},"links":{"cited_paper":"/paper/2307.02477","citing_paper":"/paper/2607.00276"},"observation_digest":"sha256:64836e17712079945c96e22ad3cc9c891e8fc7620c47524f6e2cc3f703936832","observation_id":"f43aec6a-2efa-4036-9afe-fa959a6a4af9","resolution":{"observed_at":"2026-07-02T19:27:18.684825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2307.02477/citation-record","integrity":"/paper/2307.02477/integrity","json":"/paper/2307.02477/citation-record.json","paper":"/paper/2307.02477"},"outbound":[],"paper":{"arxiv_id":"2307.02477","last_updated":"2024-03-28T23:37:24Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:50:41.385379Z","submitted_at":"2023-07-05T17:50:42Z","title":"Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2307.02477."}