{"as_of":"2026-08-08T04:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1cfbeb3887ea0ed9ffabf2c7abeb8b671ac6be635d01c1d2ac447d7cd27c61c4","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:28:47.872578Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10527/citation-record","integrity":"/paper/2506.10527/integrity","json":"/paper/2506.10527/citation-record.json","paper":"/paper/2506.10527"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.772804Z","title":"How far can transformers reason? the globality barrier and inductive scratchpad","venue":null,"work_id":"3470b629-0ad2-4536-8962-cb7c799293de","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:37.631385Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:c42f5eac868e4653600e5027dadc4d06a1ec4cdc427a18629a281e1def660844","observation_id":"13daddeb-bf98-4bd7-9a13-2efcb2f7d51f","resolution":{"observed_at":"2026-08-07T04:28:51.870479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.519955Z","title":"Graph of logic: Enhancing llm reasoning with graphs and symbolic logic","venue":null,"work_id":"801644d1-e814-493f-baa7-51afab23f405","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:39.992525Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:577cd71de8e4bb972d7896ff8bbb59d54dac4e620254f62b5dbfeb25dfbe327c","observation_id":"4a180558-2c7b-4523-96ac-45160c5a1113","resolution":{"observed_at":"2026-08-07T04:28:51.648962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:51.210860Z","title":"Claude 3.7 sonnet","venue":null,"work_id":"9206ce41-5410-4123-809a-2d48e86da977","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.109199Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:5b6d80e800a07c694fbcd365923b4124e76ee44b8662958cff0a09f6ced21394","observation_id":"5d0623af-db05-4bc4-9540-25aa8c057937","resolution":{"observed_at":"2026-08-07T04:28:51.345069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10566","last_updated":"2024-09-13T18:01:49Z","snapshot_observed_at":"2026-08-04T21:18:01.167360Z","submitted_at":"2024-09-13T18:01:49Z","title":"Eureka: Evaluating and Understanding Large Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10566","snapshot_observed_at":"2026-08-07T04:28:40.218979Z","title":"Eureka: Evaluating and understanding large foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.218979Z"},"links":{"cited_paper":"/paper/2409.10566","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:ba38a22e557260b2a566ceb113ed89abcbc469fa7c36bac04119089f9a48ee63","observation_id":"333256f3-6047-47a1-ae20-4dd8f38e1ec4","resolution":{"observed_at":"2026-08-07T04:28:40.218979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:28:40.339630Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.339630Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:3e7702ac172aaafdecca0bf38553944ce5892d16bc23a2e8eb434f2b73d0ccde","observation_id":"cffd9cab-db11-42e7-ada0-fde6f9ff23c5","resolution":{"observed_at":"2026-08-07T04:28:40.339630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14890","last_updated":"2024-02-12T17:30:25Z","snapshot_observed_at":"2026-07-06T17:07:19.721701Z","submitted_at":"2023-12-22T18:07:44Z","title":"NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14890","snapshot_observed_at":"2026-08-07T04:28:40.881171Z","title":"Nphardeval: Dynamic benchmark on reasoning ability of large language models via complexity classes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:40.881171Z"},"links":{"cited_paper":"/paper/2312.14890","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:63e44a169737a352a8af9373b8198bf1ce3e8f256f2d3817de9bfc225937091d","observation_id":"ab83d070-3c04-44dc-b9e6-6c70cba195da","resolution":{"observed_at":"2026-08-07T04:28:40.881171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04468","last_updated":"2024-11-07T06:36:19Z","snapshot_observed_at":"2026-08-04T17:52:28.620519Z","submitted_at":"2024-11-07T06:36:19Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04468","snapshot_observed_at":"2026-08-07T04:28:43.800298Z","title":"Magentic-one: A generalist multi-agent system for solving complex tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:43.800298Z"},"links":{"cited_paper":"/paper/2411.04468","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:424e139682e84302d6168cf0bf35ad70a02a7137556a69ef637875b532748b49","observation_id":"52e18b69-3525-43f3-9d0c-641f6da8c5a4","resolution":{"observed_at":"2026-08-07T04:28:43.800298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.938913Z","title":"Gemini 2.0 pro experimental","venue":null,"work_id":"2e3b5f88-a566-44d1-b931-668d407e67f4","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:43.913151Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:982fc87fe1cf70aa8f933c2945cb49d495d25a08f5b7626bee686cbf144701f5","observation_id":"e381ab0e-bd16-476e-afba-2cea2d894a18","resolution":{"observed_at":"2026-08-07T04:28:51.060732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.684305Z","title":"Gemini 2.0 flash thinking","venue":null,"work_id":"141a3521-d6f4-42b1-8ec5-22bf183e4208","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.022394Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:2e4873c542d8e332e984b9c44d654154ed710264df4cbb2ca5ea80b123d7ac05","observation_id":"6a919f3c-4495-4f5c-a3f8-3db8f25737dd","resolution":{"observed_at":"2026-08-07T04:28:50.806928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08998","snapshot_observed_at":"2026-08-07T04:28:44.141478Z","title":"Reinforced self-training (rest) for language modeling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.141478Z"},"links":{"cited_paper":"/paper/2308.08998","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:c20f291e897b9756dfa03f75782a11d118be55f2cee842d05b76bceeed8507cf","observation_id":"cdfb6979-b996-405f-b957-0f4421b6c7fe","resolution":{"observed_at":"2026-08-07T04:28:44.141478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:28:44.268329Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.268329Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:a7041e6f76ed53c8b74a3af764d0eba11d9ab8b41f912cebab3aa54bf977ec43","observation_id":"1d341136-a6eb-4881-b45a-183389793d9e","resolution":{"observed_at":"2026-08-07T04:28:44.268329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:28:44.369152Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.369152Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:77ca251bc5189e51b41cd63e514055ccbe8288f5e2b593755045fecedc513836","observation_id":"34041c10-3514-41ee-8637-d2c7787ecfc9","resolution":{"observed_at":"2026-08-07T04:28:44.369152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T04:28:44.472582Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.472582Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:ea5c85a11f6329a983e9b97550219378f16a541fb43fa17508bfaa851b53ea9a","observation_id":"e0e8ec66-628e-48b0-ab30-204a7afcd6f8","resolution":{"observed_at":"2026-08-07T04:28:44.472582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.437621Z","title":"Finding all the elementary circuits of a directed graph","venue":null,"work_id":"56e22482-c525-4142-ac05-540363ed0507","year":1975},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.662847Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:ff1dc4901fd703ba8047cb0dd50cb08eaf9f3ea67fe57442a07cb7745859e61d","observation_id":"e6c594e3-5fc4-4736-a8c4-6c679e502ebf","resolution":{"observed_at":"2026-08-07T04:28:50.551608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:50.189497Z","title":"Same task, more tokens: the impact of input length on the reasoning performance of large language models","venue":null,"work_id":"a978f8ab-73d1-48ec-9409-9e796095de41","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.779665Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:0bd9b134cdf612186098d2b03b3413f3d0e0a38efea4289723f110629574fa80","observation_id":"ee54dd7e-7624-49af-8097-9be19ed5a087","resolution":{"observed_at":"2026-08-07T04:28:50.304512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03875","last_updated":"2023-07-13T17:29:48Z","snapshot_observed_at":"2026-08-06T17:04:41.667784Z","submitted_at":"2023-07-08T01:42:22Z","title":"Large Language Models for Supply Chain Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03875","snapshot_observed_at":"2026-08-07T04:28:44.907012Z","title":"Large language models for supply chain optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:44.907012Z"},"links":{"cited_paper":"/paper/2307.03875","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:03640a97ebf24e3e3e48a6dc4a9f8c7bdd947ddda2a980b3d1b38c066c152d66","observation_id":"40a4ecee-aee7-46c8-9ade-57a6469fbfae","resolution":{"observed_at":"2026-08-07T04:28:44.907012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.909177Z","title":"Llms for relational reasoning: How far are we? In Proceedings of the 1st International Workshop on Large Language Models for Code, pp.\\ 119--126, 2024","venue":null,"work_id":"90d9a66e-7041-47b0-9911-d0b19d343130","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.061476Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:0a1ab1fbfe058b10f0747c3a12e89fd96cf2c9fad657b5fae6597ab20936e0e1","observation_id":"859e10bb-1161-4366-bb42-3df6f0a3b072","resolution":{"observed_at":"2026-08-07T04:28:50.020611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:45.169542Z","title":"Let's verify step by step","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.169542Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:7a9fd549fa190e47d1e26f4dd12f1d59e21c5c74f78a6f6c36af046954d0b3fa","observation_id":"75549691-995f-42ec-85b7-bf025908a967","resolution":{"observed_at":"2026-08-07T04:28:45.169542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01100","last_updated":"2025-07-15T01:14:25Z","snapshot_observed_at":"2026-08-07T15:35:39.413072Z","submitted_at":"2025-02-03T06:44:49Z","title":"ZebraLogic: On the Scaling Limits of LLMs for Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01100","snapshot_observed_at":"2026-08-07T04:28:45.311682Z","title":"Zebralogic: On the scaling limits of llms for logical reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.311682Z"},"links":{"cited_paper":"/paper/2502.01100","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:4e4c2e6242214c67f1ee58cee815c6093d71f1b138f2f3f57c5e76f2d7c67b67","observation_id":"0585ec8d-bfb5-4b8b-8c30-03a8a3682e69","resolution":{"observed_at":"2026-08-07T04:28:45.311682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.640300Z","title":"Evaluating cognitive maps and planning in large language models with cogeval","venue":null,"work_id":"7805fd2b-94c4-48ae-a755-9dc85962bc5f","year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.438885Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:2e59bea5226a4503713dd6928e944d1f968286c14888713cbccb2e34a2ce988d","observation_id":"1198c1e5-a59f-4cd8-a408-54ed93a49fad","resolution":{"observed_at":"2026-08-07T04:28:49.777154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.451381Z","title":"Foster, and Michael W","venue":null,"work_id":"5ad9d272-a119-4b60-844d-752190711a3d","year":2005},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.587781Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:56f1ec8f41af7e2bcce1a6ea926236c86590e6a5febadf780f41aa5f49c5b956","observation_id":"71007d16-5174-49f2-af57-cf863ebb13bb","resolution":{"observed_at":"2026-08-07T04:28:49.524885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:45.681138Z","title":"Openai o3-mini system card","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.681138Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:484001e75899d62e124ea1988a492d8d0b53092c7bc8b53d71a2b4e2d53307c2","observation_id":"8d9ed02d-68bb-4d41-9b87-63c757460c4f","resolution":{"observed_at":"2026-08-07T04:28:45.681138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:49.175865Z","title":"Logicbench: Towards systematic evaluation of logical reasoning ability of large language models","venue":null,"work_id":"e17ebe07-633a-4708-ba2c-c816696e2d2f","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.808086Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:802d786925c7dd3adc1c8d73c7e2a9f771811ab5986fe3a092267545637fe41c","observation_id":"e493e0fb-5ddf-4608-b0c2-eb598dbf49d3","resolution":{"observed_at":"2026-08-07T04:28:49.303330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17169","last_updated":"2024-10-07T03:48:18Z","snapshot_observed_at":"2026-08-05T08:42:33.944746Z","submitted_at":"2024-06-24T23:02:56Z","title":"Multi-LogiEval: Towards Evaluating Multi-Step Logical Reasoning Ability of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17169","snapshot_observed_at":"2026-08-07T04:28:45.947400Z","title":"Multi-logieval: Towards evaluating multi-step logical reasoning ability of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:45.947400Z"},"links":{"cited_paper":"/paper/2406.17169","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:5f0372569bb7e89a8b98900dfaa2d767de270912dbac905d32f590518215d8e6","observation_id":"eec52d23-b3ff-4bc4-a8f0-e17870037a28","resolution":{"observed_at":"2026-08-07T04:28:45.947400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:48.923062Z","title":"Divide and translate: Compositional first-order logic translation and verification for complex logical reasoning","venue":null,"work_id":"4287d83e-501b-4772-a97a-739a77b02cbf","year":2025},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.143857Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:a29ddc37bdd1f216c125bea8f9cb47725bd3cb5a407bf4eb22e5945ba79252e3","observation_id":"9571dae9-3f7e-403e-a0e1-e884514fadfb","resolution":{"observed_at":"2026-08-07T04:28:49.020000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13397","last_updated":"2024-06-19T09:38:59Z","snapshot_observed_at":"2026-08-04T04:49:49.358134Z","submitted_at":"2024-06-19T09:38:59Z","title":"MoreHopQA: More Than Multi-hop Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13397","snapshot_observed_at":"2026-08-07T04:28:46.289978Z","title":"Morehopqa: More than multi-hop reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.289978Z"},"links":{"cited_paper":"/paper/2406.13397","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:1f92bdfe636283cca3eb3e84e3fa7a7559b05618352e55f6428f19adfebc177a","observation_id":"da054956-7561-4149-95b1-ce862f3536ca","resolution":{"observed_at":"2026-08-07T04:28:46.289978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10502","last_updated":"2024-09-16T17:42:15Z","snapshot_observed_at":"2026-07-06T19:16:14.638445Z","submitted_at":"2024-09-16T17:42:15Z","title":"Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10502","snapshot_observed_at":"2026-08-07T04:28:46.408842Z","title":"Causal language modeling can elicit search and reasoning capabilities on logic puzzles","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.408842Z"},"links":{"cited_paper":"/paper/2409.10502","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:e80b8d6f975b017e6bce602b38d2c78c78e9850aa9522b581bb93e564a1e66e2","observation_id":"7cfadf7a-1629-496a-aadb-5c31cfd83f56","resolution":{"observed_at":"2026-08-07T04:28:46.408842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:46.557922Z","title":"Musique: Multihop questions via single-hop question composition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.557922Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:4f7380c317e63359326d31f6353d81a323fec6ae035fee87a1702c1069bed7ed","observation_id":"d708a61d-0097-4c7d-8de8-c0b73add71d0","resolution":{"observed_at":"2026-08-07T04:28:46.557922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01589","last_updated":"2023-08-03T07:48:02Z","snapshot_observed_at":"2026-07-06T16:01:58.161047Z","submitted_at":"2023-08-03T07:48:02Z","title":"Holy Grail 2.0: From Natural Language to Constraint Models","version":1},"cited_work":{"arxiv_id":"2308.01589","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.01589","snapshot_observed_at":"2026-08-07T04:28:48.169991Z","title":"Holy Grail 2.0: From Natural Language to Constraint Models","venue":"cs.AI","work_id":"0aec1ec9-ba3a-4461-b4f2-a85e6ff1a9b9","year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.653749Z"},"links":{"cited_paper":"/paper/2308.01589","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:272ca2171f72e3f74b3a4f841327b1c12a0740b974d7137b27a45a9938f31cf2","observation_id":"b8a51838-5ab7-44b6-bc01-16188e1fbe78","resolution":{"observed_at":"2026-08-07T04:28:48.259984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:46.787264Z","title":"On the planning abilities of large language models-a critical investigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.787264Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:107acde5bc46a4e851b0198e8fbd903a24474a221ab40aa5fdab93b40aff9d62","observation_id":"21847219-af4a-477b-958a-87aa8001bb95","resolution":{"observed_at":"2026-08-07T04:28:46.787264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-07-06T19:18:41.002837Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-07T04:28:46.939636Z","title":"Llms still can't plan; can lrms? a preliminary evaluation of openai's o1 on planbench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:46.939636Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:82b3065129972d969f02a34d5af540154b6c34d2c0c203bc5a73e54de2af8dbb","observation_id":"16a779d1-6d61-4191-9907-fea88806053e","resolution":{"observed_at":"2026-08-07T04:28:46.939636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14852","last_updated":"2024-11-04T21:51:07Z","snapshot_observed_at":"2026-08-06T02:17:38.157584Z","submitted_at":"2024-06-21T03:53:37Z","title":"Is A Picture Worth A Thousand Words? Delving Into Spatial Reasoning for Vision Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14852","snapshot_observed_at":"2026-08-07T04:28:47.081061Z","title":"Is a picture worth a thousand words? delving into spatial reasoning for vision language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.081061Z"},"links":{"cited_paper":"/paper/2406.14852","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:07c544bba3405884704b242f9f92a656a20056ec7b34366e1c6fac3353cab5cc","observation_id":"0a527187-c70f-4ec1-b20d-88839e383437","resolution":{"observed_at":"2026-08-07T04:28:47.081061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19924","last_updated":"2024-10-14T03:41:09Z","snapshot_observed_at":"2026-07-06T19:24:17.628876Z","submitted_at":"2024-09-30T03:58:43Z","title":"On The Planning Abilities of OpenAI's o1 Models: Feasibility, Optimality, and Generalizability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19924","snapshot_observed_at":"2026-08-07T04:28:47.210808Z","title":"On the planning abilities of openai's o1 models: Feasibility, optimality, and generalizability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.210808Z"},"links":{"cited_paper":"/paper/2409.19924","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:de2f8efbf9538e00a1a8f0634a795ad8a3fa8b9acbb5602c640014f0c4d1263e","observation_id":"eba4517b-6b66-496a-b150-5b5060f6f192","resolution":{"observed_at":"2026-08-07T04:28:47.210808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:28:48.680854Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":"d1d8e49e-6226-4592-ae1a-71171eb3c876","year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.330230Z"},"links":{"citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:04f55942e58d695193e644a29d6aef3f954724e46475f5b553c7e3a38c992115","observation_id":"d6923359-51ac-47db-a56c-e6e919cba353","resolution":{"observed_at":"2026-08-07T04:28:48.740642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-07T04:28:47.511050Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.511050Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:41747723557fffb4db239aade297eefe488194cb8e7d7d438a3dbf94e446ef43","observation_id":"2f3f4aa8-d39d-4e1d-832d-41bd705e4542","resolution":{"observed_at":"2026-08-07T04:28:47.511050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18357","last_updated":"2024-06-11T07:41:03Z","snapshot_observed_at":"2026-07-06T18:21:26.195207Z","submitted_at":"2024-05-28T16:55:33Z","title":"Faithful Logical Reasoning via Symbolic Chain-of-Thought","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18357","snapshot_observed_at":"2026-08-07T04:28:47.609701Z","title":"Faithful logical reasoning via symbolic chain-of-thought","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.609701Z"},"links":{"cited_paper":"/paper/2405.18357","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:d55247fe1df8d7bc0c145e769d855d06549695a9d4d0012539d5b43dc751a14a","observation_id":"4979fd67-1488-487f-acdc-b9661780569c","resolution":{"observed_at":"2026-08-07T04:28:47.609701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-07-31T11:19:06.421362Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-07T04:28:47.750383Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.750383Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:41461a50c73961f4c0f803254654cbce8cf5c96e7645b86450192e3352c839f5","observation_id":"5bae4fd2-961f-4349-bb38-18dbad1a73e3","resolution":{"observed_at":"2026-08-07T04:28:47.750383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04520","last_updated":"2024-06-06T21:27:35Z","snapshot_observed_at":"2026-08-07T21:28:25.786478Z","submitted_at":"2024-06-06T21:27:35Z","title":"NATURAL PLAN: Benchmarking LLMs on Natural Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04520","snapshot_observed_at":"2026-08-07T04:28:47.872578Z","title":"Natural plan: Benchmarking llms on natural language planning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:28:47.872578Z"},"links":{"cited_paper":"/paper/2406.04520","citing_paper":"/paper/2506.10527"},"observation_digest":"sha256:7ddce6faa5499faf3741418603bf997a716e810c240291b8b1d77d85ab8fa009","observation_id":"3f1b9139-7109-4809-907e-8bb7be6e5fb6","resolution":{"observed_at":"2026-08-07T04:28:47.872578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10527","last_updated":"2025-06-12T09:47:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T04:21:30.224722Z","submitted_at":"2025-06-12T09:47:02Z","title":"LogiPlan: A Structured Benchmark for Logical Planning and Relational Reasoning in LLMs"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2506.10527."}