{"as_of":"2026-08-10T19:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf652f64822d4f62a082c99f3a391da0c152083a2fcb9302d9241bd9270858f5","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:53:58.448516Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T08:40:40.910461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:40:41.541945Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"cited_work":{"arxiv_id":"2502.07087","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07087","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating the systematic reasoning abilities of large language models through graph coloring","venue":null,"work_id":"6d732a3c-23b5-45a1-8209-33953801123f","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":259,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2502.07087","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:279386a8aaa454c1614fdba0f8694fccca405d727cd5527788c3e44358c3906f","observation_id":"89aa5d30-c9ab-4169-ac72-b89355b454db","resolution":{"observed_at":"2026-05-12T08:40:41.545298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07087/citation-record","integrity":"/paper/2502.07087/integrity","json":"/paper/2502.07087/citation-record.json","paper":"/paper/2502.07087"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.343053Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.343053Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:a6f5bc18e4b9caafc1f29fa23579811bd96e86475fd18e329baf990b844388dd","observation_id":"0d3d385b-6226-4e31-a870-161a0705d6b8","resolution":{"observed_at":"2026-08-08T13:53:58.343053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.770816Z","title":"Claude 3.5 Sonnet , 2024","venue":null,"work_id":"ae8a9a6b-a243-4671-8ee4-26f6b6e33fe4","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.349218Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:5ee87dc3a44f4a40377d4c76f10876d08221cb46dc34297f9c03a00703c2cf78","observation_id":"e1a12ddb-7f55-45ba-ad4f-73451fe84156","resolution":{"observed_at":"2026-08-08T13:53:58.774725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03762","last_updated":"2023-08-10T14:24:37Z","snapshot_observed_at":"2026-08-05T14:37:13.469156Z","submitted_at":"2023-07-21T17:04:25Z","title":"GPT-4 Can't Reason","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03762","snapshot_observed_at":"2026-08-08T13:53:58.354107Z","title":"GPT-4 can't reason","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.354107Z"},"links":{"cited_paper":"/paper/2308.03762","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:b748d884b9550ee925f267eae53e8625b7f41016c16f4f8127c72aa8038b3396","observation_id":"d50af5b8-f711-45f8-98f6-893b9babe3ee","resolution":{"observed_at":"2026-08-08T13:53:58.354107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.757868Z","title":"DeepSeek-R1 : Incentivizing reasoning capability in LLMs via reinforcement learning, 2025 a","venue":null,"work_id":"a6b95f01-7a42-4a48-b02d-57461896951c","year":2025},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.359270Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:b733c4b2c8af3433e8998941e25bd865135217f6a397eeb44ad86f8d91401d5b","observation_id":"65fa7dd1-f9fb-4fb8-831e-9e143f8790c4","resolution":{"observed_at":"2026-08-08T13:53:58.761963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.744485Z","title":"DeepSeek-R1 model card, 2025 b","venue":null,"work_id":"70148485-15c7-4d61-a76b-8fe1cbc21617","year":2025},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.364348Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:9e1531ba0b3871e84c75617bc9f91885463b69b329ae902c902201308b35377e","observation_id":"9abc6e86-9f0a-46a1-a9ad-464abcfbd369","resolution":{"observed_at":"2026-08-08T13:53:58.748806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.731015Z","title":"L., Jiang, L., Lin, B","venue":null,"work_id":"5147e277-ea34-432f-a5be-dfe5587ba3cd","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.368996Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:e3b28f503af67394a5f453a920b87a649dd43a096faef7f3f1e0d5a14c45a07f","observation_id":"b2b7225e-4314-44fa-8c28-6ac86d1a5b4d","resolution":{"observed_at":"2026-08-08T13:53:58.735199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.717466Z","title":"Kimi k1.5 : Scaling reinforcement learning with LLMs , 2025","venue":null,"work_id":"8f01d836-6086-4952-ac3d-49eead35883a","year":2025},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.373693Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:d21f93a195a0e291f5693ad1f13d313d46c3884abf500c54ddd4caaf55ea32a1","observation_id":"4326786a-5b26-4ffd-a8d6-14dc41f2c514","resolution":{"observed_at":"2026-08-08T13:53:58.721861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.703969Z","title":"K., Dasgupta, I., Chan, S","venue":null,"work_id":"5a974866-9d7c-492b-85cb-a9f5ed19e90a","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.378515Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:edee5d727dd08ca81b59c8a3f5f0f2c6096318b292c0bdae52b5f3ce1ca4b0d8","observation_id":"6fb7d72f-9a0e-45c9-86f4-ac70a80e85ce","resolution":{"observed_at":"2026-08-08T13:53:58.708350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.690107Z","title":"Introducing Llama 3.1 : Our most capable models to date, 2024","venue":null,"work_id":"2af4a44c-9740-4d0d-aeb3-8000bbd93493","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.382757Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:0e75ba2adb9b109d2aa8f5de1fc09a131c626c992f96ec58608308d3abe0b04b","observation_id":"e6082ac6-0cec-4c51-8f52-da3b1e5774ec","resolution":{"observed_at":"2026-08-08T13:53:58.694698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-08T13:53:58.387372Z","title":"GSM-Symbolic : Understanding the limitations of mathematical reasoning in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.387372Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:70e86d5cc4baf891a0ab853e3f5a9a96d0108e83ded5727f2f682a2322dcfb6b","observation_id":"48f5b795-eb6c-4f2c-90fe-82f8459f3a0c","resolution":{"observed_at":"2026-08-08T13:53:58.387372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-08T13:53:58.392210Z","title":"U., Qiu, S., Saqib, M., Anwar, S., Usman, M., Akhtar, N., Barnes, N., and Mian, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.392210Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:6ed79b7bd04d4b9f233efd18ae35b7afaa5fc1ed81299af5446bb037fc1d99b5","observation_id":"1a570a10-0985-418f-b7c4-58685e3469b8","resolution":{"observed_at":"2026-08-08T13:53:58.392210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.675016Z","title":"Hello GPT-4o , 2024 a","venue":null,"work_id":"73d571ae-6d03-436e-944e-3e557f7c0b2c","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.397984Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:da45de716bd143d8c9edde89d5b53da90082435165c73ba5795ef8d3ca9b0080","observation_id":"e0b468e4-69b4-432f-b894-221578b91067","resolution":{"observed_at":"2026-08-08T13:53:58.679892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.660006Z","title":"Learning to reason with LLMs , 2024 b","venue":null,"work_id":"ac36f966-f64c-43e2-bc7f-4876d6c0ff27","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.402501Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:71aded9fd2176667be7afbabedca383e7dd1e5a37278a4d5df23c4ef26f08ab8","observation_id":"dd7cb98b-9f09-42b7-852a-0ce6e76eac11","resolution":{"observed_at":"2026-08-08T13:53:58.664477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.645618Z","title":"OpenAI o1-mini , 2024 c","venue":null,"work_id":"ed4c5186-8375-4eb3-bf17-271b25d91445","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.406833Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:3ece83b5abafb4e3ed58cd28d6a08b8c68dee9e8bae5d61f29d6fbf10e600116","observation_id":"9eace8b9-8428-49f0-a6a7-cacd9842b9de","resolution":{"observed_at":"2026-08-08T13:53:58.650040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.631592Z","title":"and Hassabis, D","venue":null,"work_id":"f5df48f4-ca50-41e1-afbc-2e62b3ddde07","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.411341Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:36e73b59b2ca41bd872ff9e1876424528956ec895e24b70db488684595c6212c","observation_id":"d099ac27-7d05-421c-83e9-4e7be89a6911","resolution":{"observed_at":"2026-08-08T13:53:58.636196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.618354Z","title":"Measuring and narrowing the compositionality gap in language models","venue":null,"work_id":"2fc30ed7-1b04-4087-863e-5d02eece4995","year":2023},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.415729Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:de84c6a96c4a8219d7b182642700e36533963dad04b8c8e3189b2451a061c94f","observation_id":"434f714e-610f-4443-81eb-c96787744229","resolution":{"observed_at":"2026-08-08T13:53:58.622448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03729","last_updated":"2024-04-01T20:56:11Z","snapshot_observed_at":"2026-08-08T12:39:46.188854Z","submitted_at":"2024-01-08T08:28:08Z","title":"The Butterfly Effect of Altering Prompts: How Small Changes and Jailbreaks Affect Large Language Model Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03729","snapshot_observed_at":"2026-08-08T13:53:58.420252Z","title":"and Morstatter, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.420252Z"},"links":{"cited_paper":"/paper/2401.03729","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:5bef60cd31ba79b7e54854f2064c2ee7670f4a800aa329d671f15158c60ed454","observation_id":"308db8f5-f1ff-4f17-9dcf-044cde671c0e","resolution":{"observed_at":"2026-08-08T13:53:58.420252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.604917Z","title":"H., Sch\\\" a rli, N., and Zhou, D","venue":null,"work_id":"b4c78aaa-05c5-475d-809e-9d61fe4a577d","year":2023},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.425090Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:742afa84571cf0f401943c3f92f56d59a7505ceea3783b8811f1cce0184f389f","observation_id":"87e53046-c0a7-4f52-81dc-71d90f61234c","resolution":{"observed_at":"2026-08-08T13:53:58.609040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08115","last_updated":"2024-08-03T21:25:31Z","snapshot_observed_at":"2026-08-10T01:47:55.445525Z","submitted_at":"2024-02-12T23:11:01Z","title":"On the Self-Verification Limitations of Large Language Models on Reasoning and Planning Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08115","snapshot_observed_at":"2026-08-08T13:53:58.429611Z","title":"On the self-verification limitations of large language models on reasoning and planning tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.429611Z"},"links":{"cited_paper":"/paper/2402.08115","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:6434f0b665157ab3715e7c4f9f03ba579d2fe92db4e4bf3ccea74acef6017e9a","observation_id":"7981cc38-c4eb-4601-9ffc-71540aa28923","resolution":{"observed_at":"2026-08-08T13:53:58.429611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13373","last_updated":"2024-09-20T10:20:46Z","snapshot_observed_at":"2026-08-10T01:01:06.663244Z","submitted_at":"2024-09-20T10:20:46Z","title":"LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13373","snapshot_observed_at":"2026-08-08T13:53:58.434511Z","title":"LLMs still can't plan; can LRMs ? a preliminary evaluation of OpenAI 's o1 on PlanBench","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.434511Z"},"links":{"cited_paper":"/paper/2409.13373","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:a407323f5508ae792d165859166e8134891e9cea29c1c8dce8874a6505b871e6","observation_id":"a252b1d1-2e84-4f6c-997d-bb3ee9f24002","resolution":{"observed_at":"2026-08-08T13:53:58.434511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15071","last_updated":"2024-10-30T18:47:53Z","snapshot_observed_at":"2026-07-06T18:19:00.169416Z","submitted_at":"2024-05-23T21:42:19Z","title":"Grokked Transformers are Implicit Reasoners: A Mechanistic Journey to the Edge of Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15071","snapshot_observed_at":"2026-08-08T13:53:58.439406Z","title":"Grokked transformers are implicit reasoners: A mechanistic journey to the edge of generalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.439406Z"},"links":{"cited_paper":"/paper/2405.15071","citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:e57bd1398a5eaf15b5d78fd72b573d65865b48a8ec51682834476baaa3677a24","observation_id":"50496835-9d32-4382-ad34-5be903cfd868","resolution":{"observed_at":"2026-08-08T13:53:58.439406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.444234Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.444234Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:3624265e51580e7faaedb2ecc251533ddf3604a7816fe5c0ce0a97212657408e","observation_id":"c7cadd4a-96ec-44d4-bab7-8ac4d3c9a951","resolution":{"observed_at":"2026-08-08T13:53:58.444234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:53:58.579855Z","title":"Larger and more instructable language models become less reliable","venue":null,"work_id":"70cd2574-519c-4f1b-8963-e5c2de55e966","year":2024},"citing_paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T13:53:58.448516Z"},"links":{"citing_paper":"/paper/2502.07087"},"observation_digest":"sha256:ac8f12caba3449647697ce51ce6f3d97aae597752e35152bd38d6540c14e70da","observation_id":"0f15cfa4-2872-4e42-8026-5218c68e6246","resolution":{"observed_at":"2026-08-08T13:53:58.586191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07087","last_updated":"2025-02-10T22:27:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T10:57:21.374418Z","submitted_at":"2025-02-10T22:27:02Z","title":"Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 1 inbound Pith citation observation for arXiv:2502.07087."}