{"as_of":"2026-08-07T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b65239694beb7fdf9511febc36c0bec6f6bcfa3166c77b30cd19771c579af9b4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:44:31.930407Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T08:36:48.288216Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:c3fbf327dca3926d97cdcc09fa1d7659215caca4af8f39976ded63126c0e823c","observation_id":"72b29544-c055-4143-ac7c-1ea19c030df1","resolution":{"observed_at":"2026-05-12T08:40:41.838340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-07T05:28:23.828084Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models // arXiv preprint arXiv:2501.14851","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07833","last_updated":"2025-06-13T17:24:38Z","snapshot_observed_at":"2026-08-07T14:52:07.143780Z","submitted_at":"2025-06-09T14:55:00Z","title":"Improving Large Language Models with Concept-Aware Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:28:23.828084Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2506.07833"},"observation_digest":"sha256:3864741aa888d8fc603b8e250cfed11b17e94349db3b2007c434a13df336d409","observation_id":"9d8e7afd-0c1b-42ec-ad31-7d2a76d554fc","resolution":{"observed_at":"2026-08-07T05:28:23.828084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T18:08:39.208031Z","title":"K.; Zhang, X.; and Tao, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15180","last_updated":"2026-05-28T16:12:56Z","snapshot_observed_at":"2026-08-05T18:08:30.380618Z","submitted_at":"2025-08-21T02:36:16Z","title":"PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T18:08:39.208031Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.15180"},"observation_digest":"sha256:fdc6feb21f9b3d7a4d3adbce5acd716913f54acefd8372b27318e21a5a9db0a9","observation_id":"f1e03c3c-9570-4a0d-85d8-caa872750e2a","resolution":{"observed_at":"2026-08-05T18:08:39.208031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T15:26:52.732798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.732798Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:cc1ba0cd4e295a9539b10ceef9667d5779f0ea68c70acc1a66d6f4b31e2ee01d","observation_id":"c3056f3b-8e04-49fa-acf3-cd2deee7a1bb","resolution":{"observed_at":"2026-08-05T15:26:52.732798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T04:42:05.339231Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models.arXiv preprint arXiv:2501.14851, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06024","last_updated":"2025-09-07T11:52:18Z","snapshot_observed_at":"2026-08-06T03:19:32.912528Z","submitted_at":"2025-09-07T11:52:18Z","title":"Rethinking Reasoning Quality in Large Language Models through Enhanced Chain-of-Thought via RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T04:42:05.339231Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2509.06024"},"observation_digest":"sha256:2c86f654fd7aa7fe210513a5dbf3a0cd457e938410aa855d402294ad94e53406","observation_id":"69fdc157-bbdc-465c-b495-18e1571d5675","resolution":{"observed_at":"2026-08-05T04:42:05.339231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-04T10:40:26.129286Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09340","last_updated":"2026-06-30T16:53:02Z","snapshot_observed_at":"2026-08-04T16:33:05.167506Z","submitted_at":"2025-10-10T12:49:00Z","title":"Deductive Logic in Language Models: Horizontal vs Vertical Reasoning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T10:40:26.129286Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2510.09340"},"observation_digest":"sha256:3af88bb6cf4ac4fb0209e555a4819c8118c2541cd3936598895a2d19ef67d179","observation_id":"6cc57450-3bb8-4c04-b73b-577b89f2e726","resolution":{"observed_at":"2026-08-04T10:40:26.129286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-03T07:39:36.528740Z","title":"Finale Doshi-Velez and Been Kim","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.18446","last_updated":"2026-06-25T03:52:17Z","snapshot_observed_at":"2026-08-03T07:39:18.978170Z","submitted_at":"2026-01-27T14:06:33Z","title":"ReportLogic: Evaluating Logical Quality in Deep Research Reports","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T07:39:36.528740Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2602.18446"},"observation_digest":"sha256:b667f7fe980c57b78474f4c29c31074f6aa571783da336f438e0c423318af4ba","observation_id":"7362ad27-72dd-4ec8-85fb-8925dfdd4e3e","resolution":{"observed_at":"2026-08-03T07:39:36.528740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2604.04443","last_updated":"2026-04-06T05:41:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-06T05:41:02Z","title":"DeonticBench: A Benchmark for Reasoning over Rules","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:03.956227Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2604.04443"},"observation_digest":"sha256:c8eae8d4d26b300d531f27653c45bee6ef032f211a770ea5da433d3aca87e9b1","observation_id":"84285226-067d-4eb5-a01d-f02e4098194e","resolution":{"observed_at":"2026-05-10T22:00:48.119873Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":"2501.14851","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-02T08:36:48.288216Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models","venue":null,"work_id":"97c02745-8fd0-492d-bac0-125a8acdfb44","year":2025},"citing_paper":{"arxiv_id":"2606.05009","last_updated":"2026-06-03T15:29:38Z","snapshot_observed_at":"2026-08-02T06:44:36.989749Z","submitted_at":"2026-06-03T15:29:38Z","title":"DAR: Deontic Reasoning with Agentic Harnesses","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T05:55:19.924704Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2606.05009"},"observation_digest":"sha256:aa8e8a814126ace6df950a5519a26640aa6a2006b088bee97771ff5bf17e92d0","observation_id":"87594534-a9fd-4b10-aec1-ec25d04af57c","resolution":{"observed_at":"2026-07-02T08:36:48.289884Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-07-12T03:54:48.803944Z","title":"Justlogic: A comprehensive benchmark for evaluating deductive reasoning in large language models.arXiv preprint arXiv:2501.14851, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.05434","last_updated":"2026-07-03T11:54:32Z","snapshot_observed_at":"2026-08-05T17:52:00.109815Z","submitted_at":"2026-07-03T11:54:32Z","title":"Abductive Corroboration of Probabilistic AI Models for Forensic Synthetic Media Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-12T03:54:48.803944Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2607.05434"},"observation_digest":"sha256:f0196a392bd9ec1b90073056650e0601ed9617a1f5ffd0f34fad633e5f2a3125","observation_id":"50bfcbe8-7b85-4fea-a663-fddc2a596235","resolution":{"observed_at":"2026-07-12T03:54:48.803944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-07T12:44:31.930407Z","title":"arXiv preprint arXiv:2501.14851 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06202","last_updated":"2026-08-06T15:58:32Z","snapshot_observed_at":"2026-08-07T17:42:26.294153Z","submitted_at":"2026-08-06T15:58:32Z","title":"What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implications (for Safety Evaluations)","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:31.930407Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2608.06202"},"observation_digest":"sha256:ee52c3c711a00217e0a73ed498510e9cc509cdd99f45963573138074f397b5de","observation_id":"1d6aa5bc-2a07-47f9-8374-28c6e9e277b0","resolution":{"observed_at":"2026-08-07T12:44:31.930407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14851/citation-record","integrity":"/paper/2501.14851/integrity","json":"/paper/2501.14851/citation-record.json","paper":"/paper/2501.14851"},"outbound":[],"paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2501.14851."}