{"as_of":"2026-08-08T11:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b298165f18f9c9cfc46906f31103ca2325dbc573b1bb79a203937fcd5872ab8e","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:52:53.361587Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.23128/citation-record","integrity":"/paper/2506.23128/integrity","json":"/paper/2506.23128/citation-record.json","paper":"/paper/2506.23128"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.05440","last_updated":"2025-03-11T18:04:52Z","snapshot_observed_at":"2026-07-06T19:29:18.770662Z","submitted_at":"2024-10-07T19:16:02Z","title":"Can LLMs Understand Time Series Anomalies?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05440","snapshot_observed_at":"2026-08-06T21:52:49.656206Z","title":"Can llms understand time series anomalies?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:49.656206Z"},"links":{"cited_paper":"/paper/2410.05440","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:b7958f8f6f2ce9a7f0448756d7aca1a231baee37cc81fa4384becb84f5e3c0d9","observation_id":"d1f53289-5778-4dea-9a20-109edb928886","resolution":{"observed_at":"2026-08-06T21:52:49.656206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01728","last_updated":"2024-01-29T06:27:53Z","snapshot_observed_at":"2026-08-04T04:31:27.172482Z","submitted_at":"2023-10-03T01:31:25Z","title":"Time-LLM: Time Series Forecasting by Reprogramming Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01728","snapshot_observed_at":"2026-08-06T21:52:49.708889Z","title":"Time-llm: Time series forecasting by re- programming large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:49.708889Z"},"links":{"cited_paper":"/paper/2310.01728","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:5d4a66e24b597760259394fd986ba284c5d57ed75528e8f381ee4399b63b621f","observation_id":"7975255f-7e6b-4e78-8932-7e4a6d3b4c54","resolution":{"observed_at":"2026-08-06T21:52:49.708889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.871773Z","title":"Ai for education (ai4edu): Advancing personalized education with llm and adaptive learning,","venue":null,"work_id":"9357434f-b342-4c1b-bf23-da7a9e412852","year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:49.761591Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:0a21843581e9f62e521ed3ef8b8498e3bf40e572c72b01bd14dfef5bd7d21bee","observation_id":"9b95299b-207f-41a4-8e36-f5ce10cc7cc1","resolution":{"observed_at":"2026-08-06T21:52:56.942159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.740155Z","title":"Software engineering education must adapt and evolve for an llm environment,","venue":null,"work_id":"ed80109d-0aae-4235-8910-9dc20d23afaf","year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:49.843669Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:61c6cc5c911ef45565c540518cb53e93ed8ffda9c99e9f80c0f499bc6b362105","observation_id":"fe42046e-6dfb-44d8-b160-f40120b91f5a","resolution":{"observed_at":"2026-08-06T21:52:56.792680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T21:52:49.907084Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:49.907084Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:3259ba54b33adf8f44c973257d7537f000a5ac063952cdba0c1a58139009d074","observation_id":"80bda44c-ca1e-4b02-83d9-74cabbfc0b44","resolution":{"observed_at":"2026-08-06T21:52:49.907084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10313","last_updated":"2024-11-24T18:44:27Z","snapshot_observed_at":"2026-07-06T18:15:24.541427Z","submitted_at":"2024-05-16T17:59:02Z","title":"How Far Are We From AGI: Are LLMs All We Need?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10313","snapshot_observed_at":"2026-08-06T21:52:50.000709Z","title":"How far are we from agi: Are llms all we need?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.000709Z"},"links":{"cited_paper":"/paper/2405.10313","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:733e7c584fd2d5075996e80b5371e7559032bff98cfd33260783cae709381eb5","observation_id":"c109a60c-35f4-4498-8206-d91418ebabd6","resolution":{"observed_at":"2026-08-06T21:52:50.000709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.528268Z","title":"Llm/gpt generative ai and artificial general intelligence (agi): The next frontier,","venue":null,"work_id":"a836470d-134c-43ec-b600-f7e7aa8aea73","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.007282Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:058f0c1d36ae33580e6faf189458078e6d1e3ba5c8fc589db151323f246b060b","observation_id":"ada5798a-386a-4439-86be-a0d10eb93d7b","resolution":{"observed_at":"2026-08-06T21:52:56.623668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11936","last_updated":"2025-05-20T14:45:21Z","snapshot_observed_at":"2026-07-06T20:07:50.399527Z","submitted_at":"2024-12-16T16:21:41Z","title":"A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11936","snapshot_observed_at":"2026-08-06T21:52:50.011424Z","title":"A survey of mathematical reasoning in the era of multimodal large language model: Benchmark, method & challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.011424Z"},"links":{"cited_paper":"/paper/2412.11936","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:3873f4aafb60b660bb9cd102babd96b355da11fe834f35f859745cf368d02d9c","observation_id":"eaa1e2b9-109e-4539-9e06-d948c0c055f4","resolution":{"observed_at":"2026-08-06T21:52:50.011424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18321","last_updated":"2024-06-26T13:02:35Z","snapshot_observed_at":"2026-08-07T23:35:19.761147Z","submitted_at":"2024-06-26T13:02:35Z","title":"MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18321","snapshot_observed_at":"2026-08-06T21:52:50.075683Z","title":"Mathodyssey: Bench- marking mathematical problem-solving skills in large language models using odyssey math data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.075683Z"},"links":{"cited_paper":"/paper/2406.18321","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:5a1844f30e0a61e63091877ebd5a602cf1f221ba14b0fced2bd80e618dc042f9","observation_id":"4fddc03b-c5a5-45a7-92f0-7713d61c9e47","resolution":{"observed_at":"2026-08-06T21:52:50.075683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15778","last_updated":"2024-10-12T11:00:25Z","snapshot_observed_at":"2026-07-06T19:07:07.234443Z","submitted_at":"2024-08-28T13:16:41Z","title":"LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15778","snapshot_observed_at":"2026-08-06T21:52:50.183141Z","title":"Logicgame: Benchmarking rule-based reasoning abilities of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.183141Z"},"links":{"cited_paper":"/paper/2408.15778","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:03e5647ea4e98b13aaa10e4245c2527de1345f960bbe8a719d179d19128cafe6","observation_id":"6c6955fe-5e2f-4772-93fb-cddf08be402c","resolution":{"observed_at":"2026-08-06T21:52:50.183141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-06T21:52:50.296981Z","title":"Logicvista: Multimodal llm logical reasoning benchmark in visual contexts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.296981Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:618e10a8a17a9b6878dd3ac0d2b6db7358641463c95763d7227ffd22c51d7a0b","observation_id":"39cdaae2-8420-4d39-b37f-166f700b5415","resolution":{"observed_at":"2026-08-06T21:52:50.296981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-06T21:52:50.387120Z","title":"Scaling relationship on learning mathematical reasoning with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.387120Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:95493cf7930ca9ddaaef5262dbb45b32eeea462f0c256e710297a1f7bdd39c02","observation_id":"34213d3b-7975-4c07-9a81-d4bd4953bd30","resolution":{"observed_at":"2026-08-06T21:52:50.387120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.359042Z","title":"Solving math word problems con- cerning systems of equations with gpt models,","venue":null,"work_id":"9def78c8-79ab-46f8-bc85-be2a22f4ddfc","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.477923Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:21a9339fb1aaa5a14ead839b7ee1d85a37c831fe3a53706fa7b1c524afa78dfb","observation_id":"09809818-7808-456f-a145-b492002d2ebe","resolution":{"observed_at":"2026-08-06T21:52:56.439080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.192703Z","title":"The mathematics of deepseek-r1: Theoretical foundations and comparative analysis,","venue":null,"work_id":"8fd37c4c-95ea-461b-a356-75618f07c593","year":2025},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.623426Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:5bc00f15b8e9d544a51dbdff83ade120a373e764f117a54c59a22ad619177bfe","observation_id":"fadbb9a9-656e-4799-8064-817476b8558d","resolution":{"observed_at":"2026-08-06T21:52:56.282901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:56.002595Z","title":"Planbench: An extensible benchmark for evaluating large language models on planning and reasoning about change,","venue":null,"work_id":"ad9d7860-a758-4e2e-9625-c8ffd00ac78b","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.754674Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:8983a0093c0b41c1a565fefd340b0b0b4700f8351174f6d6ff19a4380243b2a8","observation_id":"23a0e61b-5557-4fe5-a519-3851bc4a4c88","resolution":{"observed_at":"2026-08-06T21:52:56.075027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:55.814797Z","title":"Neurocognitive development of rela- tional reasoning,","venue":null,"work_id":"724f9041-7b9e-428c-b8d1-2fe3d5575748","year":2009},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:50.887247Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:1fd543ba7ce94bf9cb62353bde87fbc60a5b7d08f6c65ed73fc9a1827b36f252","observation_id":"8e393966-c146-4cf0-ad6c-862c5afce9fe","resolution":{"observed_at":"2026-08-06T21:52:55.905548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:55.629656Z","title":"Processing capacity defined by relational complexity: Implications for comparative, devel- opmental, and cognitive psychology,","venue":null,"work_id":"ec5fe643-2fb7-4857-9983-dd5f89ba1fa8","year":1998},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.033478Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:45f0355b3042024fe9949026ddce3c476f90691b16a39a239820c122811a6b6a","observation_id":"ee122da3-25e7-433d-96ff-d8f2e9b79bd3","resolution":{"observed_at":"2026-08-06T21:52:55.722086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:55.443492Z","title":"Llms for relational reasoning: How far are we?","venue":null,"work_id":"940d1b0a-335e-49f6-ab4c-831262d227f7","year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.159742Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:ac66718bf78a17333affce08e126feda68e04bcf83e81adfe2f6d13c5c0fd42f","observation_id":"006d5740-023e-480f-bd1a-656348055bed","resolution":{"observed_at":"2026-08-06T21:52:55.540805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09210","last_updated":"2023-02-18T02:11:36Z","snapshot_observed_at":"2026-08-08T03:31:17.640404Z","submitted_at":"2023-02-18T02:11:36Z","title":"How Good Are GPT Models at Machine Translation? A Comprehensive Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09210","snapshot_observed_at":"2026-08-06T21:52:51.306115Z","title":"How good are gpt models at machine translation? a comprehensive evaluation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.306115Z"},"links":{"cited_paper":"/paper/2302.09210","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:c283724bf9d6dd3f7942745fdc67325c1c5a41acffef236a3ae9028ec2e3dc5e","observation_id":"a6e3f251-1ffb-4d9f-adb1-5fd8e2ad0803","resolution":{"observed_at":"2026-08-06T21:52:51.306115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16153","last_updated":"2024-02-25T17:19:41Z","snapshot_observed_at":"2026-07-06T17:35:10.248760Z","submitted_at":"2024-02-25T17:19:41Z","title":"ChatMusician: Understanding and Generating Music Intrinsically with LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16153","snapshot_observed_at":"2026-08-06T21:52:51.473082Z","title":"Chatmusician: Understanding and generating music intrinsically with llm,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.473082Z"},"links":{"cited_paper":"/paper/2402.16153","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:6fdf3eb4eee2afefd76c0ae664716aa03355e79130aa18edfff86efb6af036ca","observation_id":"0d728047-ee83-440c-9434-6753f7ace73f","resolution":{"observed_at":"2026-08-06T21:52:51.473082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:51.593691Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.593691Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:a86f88003f65f0c8b04ea1d703b2be34d75dd439bbcdfe45b690f0b4edd93ec3","observation_id":"a339490b-291e-4fb7-b8e2-3d305e3b67b6","resolution":{"observed_at":"2026-08-06T21:52:51.593691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:55.151312Z","title":"Multimodal prompt- ing with missing modalities for visual recognition,","venue":null,"work_id":"bac51658-6b6d-417f-bc68-1eea759b123e","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.753253Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:37226ebe0111346557474532747095538be59013e9b839f7f1a90cc66a49deb0","observation_id":"ed62c14a-13ff-4d8c-b63c-6a4fb6bfcd34","resolution":{"observed_at":"2026-08-06T21:52:55.305579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:54.897608Z","title":"Next-gpt: Any-to-any multimodal llm,","venue":null,"work_id":"90d9b7a5-2801-4368-9316-86cee3d9f216","year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:51.919819Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:58c4da0ffafd059a7a35c3860b5b36991f1299d70251f337d6ff5466d9e2495f","observation_id":"fca669d8-40af-47da-b15a-debff66471a4","resolution":{"observed_at":"2026-08-06T21:52:54.994316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:52.083541Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.083541Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:abf5de6021e1e7a04ef149543b7c86ed5e1d1b3c1bad70b129c9840e54932cb8","observation_id":"bc9aa145-bf89-46d3-bc23-a3097a2e8f5a","resolution":{"observed_at":"2026-08-06T21:52:52.083541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:52.193113Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.193113Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:bccaa4644031141e336f5cf2623a67c767f0f8111e8662783d04725d3e30d286","observation_id":"cac18a67-0fc2-44a6-9d79-09768fcfcd93","resolution":{"observed_at":"2026-08-06T21:52:52.193113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:52.318467Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.318467Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:52a37d3a4e0e1ef859be45af15d34ba97102d35c373fb1d560d246da378b3c8e","observation_id":"a4e3dd82-696f-4acd-bea5-40c51fdcaba7","resolution":{"observed_at":"2026-08-06T21:52:52.318467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11495","last_updated":"2023-09-25T15:25:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-20T17:50:55Z","title":"Chain-of-Verification Reduces Hallucination in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11495","snapshot_observed_at":"2026-08-06T21:52:52.407048Z","title":"Chain-of-verification reduces hallucination in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.407048Z"},"links":{"cited_paper":"/paper/2309.11495","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:5de58ca78bccad6c4160ac59c644b08117c382f5fa6ed3179817a2debdcc5638","observation_id":"9755c05d-090a-46aa-a185-ae4dbff6bd20","resolution":{"observed_at":"2026-08-06T21:52:52.407048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:52.515163Z","title":"Tree of thoughts: Deliberate problem solving with large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.515163Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:73641c242e14fed24f354b0c424f55969000897e875a513762f6d912e3bd6349","observation_id":"e9d6db86-42cf-4aeb-9e40-6bdf44cfdee2","resolution":{"observed_at":"2026-08-06T21:52:52.515163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:52.596521Z","title":"Large lan- guage models are zero-shot reasoners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.596521Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:1d73948caaee2d7fd6ddf15ded9800d1f982674d59b3d23e3b3a3babd0423cc8","observation_id":"1d20e3f8-27e2-43cb-a2cf-7b08de95ca59","resolution":{"observed_at":"2026-08-06T21:52:52.596521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:54.628990Z","title":"Prompt engineering for zero- shot and few-shot defect detection and classification using a visual- language pretrained model,","venue":null,"work_id":"7e46a967-58af-4175-ae28-90638c640d9e","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.706146Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:77aa4f0558d88af616b4f84a2431b1a5166b933cf239284199fadce1fb367fb7","observation_id":"705fc5a1-7c7b-4a4a-9cea-15086e065a72","resolution":{"observed_at":"2026-08-06T21:52:54.721079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:54.505410Z","title":"Vita-clip: Video and text adaptive clip via multimodal prompting,","venue":null,"work_id":"5e577202-967f-4643-832c-99a0c8737ca6","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.813902Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:4d4816b5e4743c201286b68f49a4532c70dcafed06bdc689b29e42aec078dabf","observation_id":"a44b8a5c-b8e5-4a4e-baa7-3b51bd6c7ea0","resolution":{"observed_at":"2026-08-06T21:52:54.565967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:54.342746Z","title":"Worldgpt: Empowering llm as multimodal world model,","venue":null,"work_id":"b422046b-827a-42f1-a302-ac08c0dcb607","year":2024},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:52.926421Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:30090bea04ca006b8cd3474aeba14b49eca525eb11466c5a0564fc2d3201e060","observation_id":"491ab124-09e4-4215-8f3f-28ad101a830c","resolution":{"observed_at":"2026-08-06T21:52:54.422242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:54.157210Z","title":"Neural logic machines,","venue":null,"work_id":"8b0894b6-25c5-4857-85f2-746c396e5b6f","year":null},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.004583Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:30f45ec317b79ea70ac786c82359f734eeef45c18a1c0c4a7296f6873b0a825e","observation_id":"17e43a17-bc5c-43e1-a396-9827688bf028","resolution":{"observed_at":"2026-08-06T21:52:54.255326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:53.992252Z","title":"Differentiable logic machines,","venue":null,"work_id":"a6b77544-386d-4181-bdd8-25bf17f07db1","year":2023},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.085751Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:42251a0d8bf0eeac1f10e9ac98cc3b61dc8b5f6767cd419735985cb70e927b8e","observation_id":"0e4bd2c4-b816-40ab-8537-45bcf1e8aa2d","resolution":{"observed_at":"2026-08-06T21:52:54.045409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:53.826336Z","title":"Learning explanatory rules from noisy data,","venue":null,"work_id":"490a3b22-0733-4c78-bb39-39316f5e5d05","year":2018},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.142901Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:7882607ad5cd503860328de298674b9eb27953dddfefddd16aac6cb04a805f29","observation_id":"b8ae5958-4be8-4ba4-84c6-7464158ce8b2","resolution":{"observed_at":"2026-08-06T21:52:53.902311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:52:53.679245Z","title":"Neural probabilistic logic programming in deepproblog,","venue":null,"work_id":"19f9f56c-526d-4860-ae9a-668f918a0113","year":2021},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.223726Z"},"links":{"citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:288d47be2d35fe68091417d7bf5eea74c57e0ccf5084cb27e02621c253610430","observation_id":"ff210251-0fcc-4622-8c9e-a8af3595f06f","resolution":{"observed_at":"2026-08-06T21:52:53.748829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09100","last_updated":"2025-02-13T09:19:14Z","snapshot_observed_at":"2026-08-07T23:33:03.134022Z","submitted_at":"2025-02-13T09:19:14Z","title":"Logical Reasoning in Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09100","snapshot_observed_at":"2026-08-06T21:52:53.280834Z","title":"Logical reasoning in large language models: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.280834Z"},"links":{"cited_paper":"/paper/2502.09100","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:84bd36952c4d9b4fe94092e6aae07098cf41730a813ad45e28f0e63972b6ef99","observation_id":"bf096a3d-ac9d-45e2-9be7-52d992820e24","resolution":{"observed_at":"2026-08-06T21:52:53.280834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.11694","last_updated":"2019-04-26T06:52:53Z","snapshot_observed_at":"2026-07-06T07:48:36.708287Z","submitted_at":"2019-04-26T06:52:53Z","title":"Neural Logic Machines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.11694","snapshot_observed_at":"2026-08-06T21:52:53.361587Z","title":"Neural logic machines,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:52:53.361587Z"},"links":{"cited_paper":"/paper/1904.11694","citing_paper":"/paper/2506.23128"},"observation_digest":"sha256:9329f6b4cc790666f9f194b469c914b609ba85249102223707e067545db0b707","observation_id":"eafdb9c7-b658-4d84-8848-f1c98f16410d","resolution":{"observed_at":"2026-08-06T21:52:53.361587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23128","last_updated":"2025-06-29T07:37:49Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T23:33:22.677915Z","submitted_at":"2025-06-29T07:37:49Z","title":"Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.23128."}