{"as_of":"2026-08-21T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61cb84ba844f45fc6fae4491a448b07421cf77ffb227474f483b4e6bc8a0edf2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:24:24.117256Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T18:31:44.623520Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-10T22:48:53.560481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.00759","last_updated":"2025-07-10T07:45:30Z","snapshot_observed_at":"2026-08-14T13:08:58.878185Z","submitted_at":"2025-01-01T07:05:32Z","title":"Enhancing Transformers for Generalizable First-Order Logical Entailment","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T22:48:53.560481Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2501.00759"},"observation_digest":"sha256:b157c130bac0f66c444b54f4ba17b11a96833d50aeb1f8d6229d89ffdfd07175","observation_id":"5ab0e704-cf2f-4298-af86-26d990931283","resolution":{"observed_at":"2026-08-10T22:48:53.560481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-08T14:46:41.032275Z","title":"arXiv preprint arXiv:2404.15522 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06669","last_updated":"2025-02-10T16:54:03Z","snapshot_observed_at":"2026-08-18T18:29:49.251332Z","submitted_at":"2025-02-10T16:54:03Z","title":"Boosting Self-Efficacy and Performance of Large Language Models via Verbal Efficacy Stimulations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:46:41.032275Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2502.06669"},"observation_digest":"sha256:feddafe5f87abb42d3a5de2a0dae59db0d8af528b2dc1c623841758899b1c4a4","observation_id":"55ea891f-6fc9-4345-a66f-146e99f7de15","resolution":{"observed_at":"2026-08-08T14:46:41.032275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-16T05:24:24.117256Z","title":"Towards systematic evaluation of logical reasoning ability of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20771","last_updated":"2025-05-19T03:55:13Z","snapshot_observed_at":"2026-08-19T02:03:01.058892Z","submitted_at":"2025-04-29T13:52:47Z","title":"Computational Reasoning of Large Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:24:24.117256Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2504.20771"},"observation_digest":"sha256:ddf2ca9f45061a4c92587103c11e305bea80d56cfcb4a97060f70d11da3c0edc","observation_id":"5a67629b-de4b-4984-99ee-a77bf9081f80","resolution":{"observed_at":"2026-08-16T05:24:24.117256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-07T12:11:13.215948Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-09T10:36:52.271268Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:13.215948Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6ad74f691ba0be1e9d28346b7aa68b3a3a899c03e8720f4e25adc2f4751739ac","observation_id":"4201fc29-0509-4782-83bb-4ef2f3b2b8bb","resolution":{"observed_at":"2026-08-07T12:11:13.215948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-06T11:04:47.237610Z","title":"doi: 10.18653/v1/D18-1259","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23170","last_updated":"2025-08-02T05:05:26Z","snapshot_observed_at":"2026-08-20T23:44:40.525401Z","submitted_at":"2025-07-31T00:51:16Z","title":"BAR Conjecture: the Feasibility of Inference Budget-Constrained LLM Services with Authenticity and Reasoning","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T11:04:47.237610Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2507.23170"},"observation_digest":"sha256:ea69b493e125b994b5d3a51ac351c3119d9778b240894083ae04fb04a8a4394c","observation_id":"53813fa4-b8c5-430f-86d1-f321aa31da0f","resolution":{"observed_at":"2026-08-06T11:04:47.237610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-06T05:41:42.117693Z","title":"Parmar, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01539","last_updated":"2025-08-03T01:46:10Z","snapshot_observed_at":"2026-08-16T22:39:04.174569Z","submitted_at":"2025-08-03T01:46:10Z","title":"HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:41:42.117693Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2508.01539"},"observation_digest":"sha256:eff9194ed4d3a6b0bada07e159b4b37ee233ff6f084845cec409bdbb079e865d","observation_id":"a5dbacfa-40e5-4177-9235-3f517a90ed75","resolution":{"observed_at":"2026-08-06T05:41:42.117693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-05T18:08:43.092102Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.15180","last_updated":"2026-05-28T16:12:56Z","snapshot_observed_at":"2026-08-15T06:52:27.067194Z","submitted_at":"2025-08-21T02:36:16Z","title":"PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T18:08:43.092102Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2508.15180"},"observation_digest":"sha256:467264b987d4cced087f3f2ac8b7febb66fcf89d85d774e3d99bfde278f19605","observation_id":"f43b4129-4a13-48a5-b28b-1a658df5655a","resolution":{"observed_at":"2026-08-05T18:08:43.092102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.15522","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models","venue":null,"work_id":"f107c414-d5bb-4321-a40a-df870b2190eb","year":2024},"citing_paper":{"arxiv_id":"2509.05489","last_updated":"2026-04-16T20:13:16Z","snapshot_observed_at":"2026-08-12T18:34:11.831197Z","submitted_at":"2025-09-05T20:39:43Z","title":"Self-Aligned Reward: Towards Effective and Efficient Reasoners","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-18T18:27:23.076544Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2509.05489"},"observation_digest":"sha256:45680a4f31a8685c77960b67a8f9bf41720c5857ac4e19997d3fefc4c48abc15","observation_id":"face0bee-84d8-40ce-a37e-b282b40a2e71","resolution":{"observed_at":"2026-05-18T18:31:44.625901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-04T09:39:47.686180Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models.arXiv preprint arXiv:2404.15522, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.17868","last_updated":"2026-07-15T10:42:46Z","snapshot_observed_at":"2026-08-08T11:51:53.258994Z","submitted_at":"2025-10-16T05:07:12Z","title":"UniCode: Augmenting Evaluation for Code Reasoning","version":3},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-04T09:39:47.686180Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2510.17868"},"observation_digest":"sha256:aa67751709a7015545a58c5862f87f29b9b2b08fda9e961551496b730f652e47","observation_id":"f9abc7f1-d0a3-4ad0-a0c1-f462ebf1ec15","resolution":{"observed_at":"2026-08-04T09:39:47.686180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-03T09:42:58.223989Z","title":"questions","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2602.11173","last_updated":"2026-05-23T16:54:44Z","snapshot_observed_at":"2026-08-06T20:08:21.162373Z","submitted_at":"2026-01-19T14:07:10Z","title":"Author-in-the-Loop Response Generation and Evaluation: Integrating Author Expertise and Intent in Responses to Peer Review","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T09:42:58.223989Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2602.11173"},"observation_digest":"sha256:8b0fa44ce0f9aa4187ad41e1ba0d6e763c01e8a5a3a355271dcb82426112efff","observation_id":"982d34ca-6019-45b2-ad98-773a2f9aa53a","resolution":{"observed_at":"2026-08-03T09:42:58.223989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.15522","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models","venue":null,"work_id":"f107c414-d5bb-4321-a40a-df870b2190eb","year":2024},"citing_paper":{"arxiv_id":"2605.05741","last_updated":"2026-05-07T06:32:57Z","snapshot_observed_at":"2026-08-17T19:38:48.914653Z","submitted_at":"2026-05-07T06:32:57Z","title":"HyperLens: Quantifying Cognitive Effort in LLMs with Fine-grained Confidence Trajectory","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-08T11:38:49.630171Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2605.05741"},"observation_digest":"sha256:be4b28ac3fa89c7cc07b784dc4171d921dad1f4649242fc7d03df50f90622be1","observation_id":"34bd2d4e-085c-4dc3-90ce-571afc952d0d","resolution":{"observed_at":"2026-05-11T19:36:09.585732Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15522","snapshot_observed_at":"2026-08-02T12:14:23.445389Z","title":"arXiv preprint arXiv:2404.15522 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19364","last_updated":"2026-08-11T12:45:56Z","snapshot_observed_at":"2026-08-18T02:47:01.984498Z","submitted_at":"2026-06-05T19:27:31Z","title":"SAE-StatSteer: Statistical Consensus Feature Selection for Optimization-Free Activation Steering of Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T12:14:23.445389Z"},"links":{"cited_paper":"/paper/2404.15522","citing_paper":"/paper/2607.19364"},"observation_digest":"sha256:38e8b8fb1a1381c7cc042757d650e6c255108f7f29f080cc80ceebbc38bde711","observation_id":"6b3a175f-ba4e-4b38-ae9e-fe6c940a92f0","resolution":{"observed_at":"2026-08-02T12:14:23.445389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2404.15522/citation-record","integrity":"/paper/2404.15522/integrity","json":"/paper/2404.15522/citation-record.json","paper":"/paper/2404.15522"},"outbound":[],"paper":{"arxiv_id":"2404.15522","last_updated":"2024-06-06T08:15:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:58:22.325772Z","submitted_at":"2024-04-23T21:08:49Z","title":"LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2404.15522."}