{"as_of":"2026-08-16T21:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57a9fbbf993df6e096c93d78059f103effc21eb6c14ddcb0bcc7299ecbc602c0","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:21:21.611008Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:21:12.095738Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T16:37:40.076816Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2505.13307","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13307","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rbf++: Quantifying and optimizing reasoning boundaries across measurable and unmeasurable capabilities for chain- of-thought reasoning","venue":null,"work_id":"be6782d0-e96d-483b-831b-a4fb2c50bdfc","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2505.13307","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:7957abe02043729bcd9d4ed0b40697e48b3e6aa5b0bf3b0762d78ae72c89a31b","observation_id":"77c179dc-385a-492c-bbcb-bb63056fcac1","resolution":{"observed_at":"2026-05-12T08:40:41.853000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13307","snapshot_observed_at":"2026-08-15T23:21:12.095738Z","title":"Rbf++: Quantifying and optimizing reasoning boundaries across measurable and unmeasurable capabilities for chain-of-thought reasoning, 2025 d","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.04921","last_updated":"2025-07-06T14:40:27Z","snapshot_observed_at":"2026-08-15T23:15:46.193892Z","submitted_at":"2025-05-08T03:35:23Z","title":"Perception, Reason, Think, and Plan: A Survey on Large Multimodal Reasoning Models","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T23:21:12.095738Z"},"links":{"cited_paper":"/paper/2505.13307","citing_paper":"/paper/2505.04921"},"observation_digest":"sha256:894bea0e0cd2792b383d0fc6bbbb1571dc1535a68bd95624355b5f98b0e9a4a7","observation_id":"8b8b8fb4-4e33-46f0-bc71-d309f17be26f","resolution":{"observed_at":"2026-08-15T23:21:12.095738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13307","snapshot_observed_at":"2026-08-06T20:45:12.259767Z","title":"Rbf++: Quantifying and optimizing reasoning boundaries across measurable and unmeasurable capabilities for chain-of-thought reasoning.arXiv preprint arXiv:2505.13307, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.01903","last_updated":"2025-08-05T16:19:40Z","snapshot_observed_at":"2026-08-08T04:30:09.801268Z","submitted_at":"2025-07-02T17:19:20Z","title":"AI4Research: A Survey of Artificial Intelligence for Scientific Research","version":2},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:12.259767Z"},"links":{"cited_paper":"/paper/2505.13307","citing_paper":"/paper/2507.01903"},"observation_digest":"sha256:591154bc6c277b157f3d7134bfce3ca6610497a0d1ee1b883dc373a9665f9a07","observation_id":"becadbe7-04b9-4418-838e-4802b9b53b35","resolution":{"observed_at":"2026-08-06T20:45:12.259767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2505.13307","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.13307","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rbf++: Quantifying and optimizing reasoning boundaries across measurable and unmeasurable capabilities for chain- of-thought reasoning","venue":null,"work_id":"be6782d0-e96d-483b-831b-a4fb2c50bdfc","year":2025},"citing_paper":{"arxiv_id":"2605.14859","last_updated":"2026-05-15T03:53:20Z","snapshot_observed_at":"2026-08-16T16:39:04.165278Z","submitted_at":"2026-05-14T14:05:58Z","title":"Do Coding Agents Understand Least-Privilege Authorization?","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T16:34:14.379419Z"},"links":{"cited_paper":"/paper/2505.13307","citing_paper":"/paper/2605.14859"},"observation_digest":"sha256:709c383619268226a522a4bdebc485ca90a9e1f3e96e1065e0287e24e95d5b21","observation_id":"379d6d96-b78e-47b7-9fc7-89b01701133d","resolution":{"observed_at":"2026-05-19T16:37:40.078710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.13307/citation-record","integrity":"/paper/2505.13307/integrity","json":"/paper/2505.13307/citation-record.json","paper":"/paper/2505.13307"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.957901Z","title":"Unlocking the capabilities of thought: A reasoning boundary framework to quantify and optimize chain-of-thought,","venue":null,"work_id":"c4159bef-32fd-4eb8-91bb-0de14854f349","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.273860Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:531bd8ea9a2e10e413841f28a2df52e1682b1624a3eef8a04f636aa4ebe50100","observation_id":"d37d43ba-b469-4044-b84c-587e018e7cdf","resolution":{"observed_at":"2026-08-15T20:21:22.962828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-15T20:21:21.279117Z","title":"A survey of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.279117Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:5564edb1d4f530d7db365bb80d02ea87b95ece442c8fd7f85d4af642ba4d3a82","observation_id":"3beb57ad-5b63-4420-91cf-18763e65841d","resolution":{"observed_at":"2026-08-15T20:21:21.279117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04256","last_updated":"2023-04-09T15:28:36Z","snapshot_observed_at":"2026-08-16T15:41:44.337561Z","submitted_at":"2023-04-09T15:28:36Z","title":"A Preliminary Evaluation of ChatGPT for Zero-shot Dialogue Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04256","snapshot_observed_at":"2026-08-15T20:21:21.285006Z","title":"A preliminary evaluation of chatgpt for zero-shot dialogue understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.285006Z"},"links":{"cited_paper":"/paper/2304.04256","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:657f757590a5788a84b59bc332efd159a08fe70b0492a3617850df6ddf2cce5a","observation_id":"43ea7665-9586-417a-b044-23d2ae3e625c","resolution":{"observed_at":"2026-08-15T20:21:21.285006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12819","last_updated":"2025-08-25T02:35:43Z","snapshot_observed_at":"2026-08-16T13:50:57.018282Z","submitted_at":"2024-05-21T14:24:01Z","title":"Large Language Models Meet NLP: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12819","snapshot_observed_at":"2026-08-15T20:21:21.290194Z","title":"Large language models meet nlp: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.290194Z"},"links":{"cited_paper":"/paper/2405.12819","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:4e2d0bf55e10188cb66aa4fa4461c649de81812e3546919c179d772c92959b5c","observation_id":"572cd95a-d273-4359-9c49-169e04d4ed31","resolution":{"observed_at":"2026-08-15T20:21:21.290194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.295343Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.295343Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:c81a515f0423e6d2e3e5c23ec9be407bcd9b3850d5e95b2be86d59e1d330c7e1","observation_id":"b39d09bf-a24e-419b-8679-c1d1a94a8540","resolution":{"observed_at":"2026-08-15T20:21:21.295343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.931409Z","title":"Introducing chatgpt,","venue":null,"work_id":"74635a04-169b-4401-8526-053c214fb085","year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.300212Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:63b5ae52dc96391f70e45a7bf8324482dd1d86281da33d7ea8d2a00d0cdebc72","observation_id":"3393cbc8-eb56-421b-9e60-fb6813c21c2e","resolution":{"observed_at":"2026-08-15T20:21:22.937213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T20:21:21.305272Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.305272Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:c57ccbfd836ff3787c03eda8b8111a7e15054bcdce8b76a224b7c176ff855230","observation_id":"4a9a531b-784d-4a5f-88d9-0c3e2f9e8198","resolution":{"observed_at":"2026-08-15T20:21:21.305272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T20:21:21.310023Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.310023Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:6900281beff349a93261f4d0e773f9b13e5569574c54bae10f037288a13f59e3","observation_id":"27533b30-df94-4770-9c66-241c472b48c1","resolution":{"observed_at":"2026-08-15T20:21:21.310023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:21:21.314459Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.314459Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:8b9f470243896c868df25d2287ccb891dd739c2f73979e8b40129c1ea323f2b1","observation_id":"63ccb703-2db4-4da5-97c6-69930778ee7a","resolution":{"observed_at":"2026-08-15T20:21:21.314459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.915540Z","title":"Show your work: Scratchpads for intermediate computation with language models,","venue":null,"work_id":"a847d494-f0f0-49e4-ba70-663f73324b85","year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.319041Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:adad989595573bb5d8ad3c365033a040b7bc772a2cf9776faee538144f98e5b7","observation_id":"9f012081-2974-46a8-91e2-417aa7156d41","resolution":{"observed_at":"2026-08-15T20:21:22.920586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.324481Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.324481Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:3edc6553fc5c44080383093a0f9d285b1d3e83d4c5f9d3e33aca29de6ce51bd0","observation_id":"c12dfa99-b015-488d-a9e3-2035baea83cf","resolution":{"observed_at":"2026-08-15T20:21:21.324481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.888387Z","title":"Navcot: Boosting llm-based vision-and-language navigation via learning disentangled reasoning,","venue":null,"work_id":"a704a454-7ef5-465d-be38-5568cf4ca3cf","year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.329365Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:b09c40ad051101cfc6cb3c579d05476bafca045136de19e69b56af35be043815","observation_id":"e39a8ef8-ed82-4fc1-afc0-de2c9b3838d6","resolution":{"observed_at":"2026-08-15T20:21:22.894609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.333779Z","title":"Large language models are zero-shot reasoners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.333779Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:3f86eccf81226d9a06fbab8ebbf976a40a809ec145149b7480dfc320c5ec5556","observation_id":"8fab8abe-2f8b-4a1d-9b47-2f03e89b789f","resolution":{"observed_at":"2026-08-15T20:21:21.333779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.862794Z","title":"Tree-planner: Efficient close-loop task planning with large language models,","venue":null,"work_id":"d7cf8256-3f44-4b30-890d-66f129ec8a66","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.338264Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:e8b84b3190eec7c19202a334a42e7a60e57a38d0ae322aef1ebc2481cf7441fb","observation_id":"df4c7e43-b0a5-4148-ac38-ad7d20cd7788","resolution":{"observed_at":"2026-08-15T20:21:22.868144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.847524Z","title":"Cross-lingual prompting: Improving zero-shot chain-of-thought reasoning across languages,","venue":null,"work_id":"3189c61f-0029-43d5-98c4-b5b4e46687d7","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.343069Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:7d6ea5a16b66b2c81b2ff530908099c0fdcbb3a702df29919b6c27bb6859dd9a","observation_id":"19c289f2-7937-47ab-b56c-e9f2c6a054f0","resolution":{"observed_at":"2026-08-15T20:21:22.852564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.832571Z","title":"Reason and discovery: A new paradigm for open set recognition,","venue":null,"work_id":"673b89c7-80a1-4103-9ac6-5049c97b2455","year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.347323Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:5278f536bc27d660f8a388490a77e7738f5efda5c439d625e4097f8ca8fe955b","observation_id":"1f265aa7-d024-48e1-ab6c-e9d69ea5a45a","resolution":{"observed_at":"2026-08-15T20:21:22.837654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.817061Z","title":"M 3CoT: A novel benchmark for multi-domain multi-step multi-modal chain-of- thought,","venue":null,"work_id":"deabfb16-35a4-438a-b3bc-5babe7cfed9e","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.352275Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:58ff926f4af62d621e9839d4b2f7088141df9943489c10e61eff4e399028b8ac","observation_id":"848074f7-68ee-4a81-aa69-f0b51cb6aad7","resolution":{"observed_at":"2026-08-15T20:21:22.822305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.800797Z","title":"What makes chain-of- thought prompting effective? a counterfactual study,","venue":null,"work_id":"ebee8ecf-711b-4181-93f0-aeb9b0d5904a","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.356565Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:72b9cae38ef9ec02c2d9bb13a85c0e68e3f6eba272e9cb05fe0340716b8e1f76","observation_id":"41daf768-0329-4fa8-ab29-387c1503b687","resolution":{"observed_at":"2026-08-15T20:21:22.806078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.784817Z","title":"Towards understanding chain-of-thought prompting: An empirical study of what matters,","venue":null,"work_id":"08ef35ff-0f8e-4df0-9f93-a13d3aaaad8a","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.361117Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:6695c8350b1fe2923abd24708d421a492026ead7b063e8f49f7b688b44e93527","observation_id":"dd1b0de2-c79e-4e87-b478-363098831ca6","resolution":{"observed_at":"2026-08-15T20:21:22.790165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.769298Z","title":"When do program-of-thought works for reasoning?","venue":null,"work_id":"f293feab-ae8b-4eb1-89f7-5d6077bb14ed","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.365277Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:1025c265a47576681537f170fd55da4a336c07eb7a1fae6048d260bd03b9c73a","observation_id":"76d40e69-83ea-474b-8b6f-03fe12b024e9","resolution":{"observed_at":"2026-08-15T20:21:22.774469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.753716Z","title":"Towards revealing the mystery behind chain of thought: a theoretical perspective,","venue":null,"work_id":"b09c1f65-c41f-490a-8735-c2a7f8bc7d45","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.369788Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:a2b3d88f1b6effae6f85158bda2dad369784821941eae43cd7436da7dfa80ff8","observation_id":"68dcd710-cb25-4ded-838e-e059c5f6c358","resolution":{"observed_at":"2026-08-15T20:21:22.758655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-15T20:21:21.374235Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.374235Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:b1347cef6724988195e586e2ffb24119858e5df18030f2d8adcb50304f135259","observation_id":"a74b22ec-9244-497b-a02a-b9fa87a1f191","resolution":{"observed_at":"2026-08-15T20:21:21.374235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.736622Z","title":"OlympiadBench: A challenging benchmark for promoting AGI with olympiad-level bilingual multimodal scientific problems,","venue":null,"work_id":"a62b057a-961c-4cd6-b030-d8153e8cecda","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.378667Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:626bb952a89b40cf179791412097678f691762a0fc0f16fefdb0d85b1d89aab2","observation_id":"dc5a3b8f-983c-4c93-9b95-12bcb8530c5a","resolution":{"observed_at":"2026-08-15T20:21:22.742099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.717255Z","title":"PAL: Program-aided language models,","venue":null,"work_id":"53d7113c-f7a2-4000-827a-c52abb8cf32a","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.383467Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:e4ea1fa53f25da045ffce28dee82fcceff903de7416b830039cff2e0612d59db","observation_id":"246e1728-dc2c-43e1-a881-05ba2d111d1e","resolution":{"observed_at":"2026-08-15T20:21:22.723528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.700394Z","title":"Causal abstraction for chain-of-thought reasoning in arithmetic word problems,","venue":null,"work_id":"ec4e756a-18ed-4aca-8cb7-cd497f8975a0","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.388102Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:cb19d74a2659d0651d8f1da897b09f5118b704a13f1cf1bb65574486bff0cdab","observation_id":"9b04ee5e-1dd2-4f13-8170-f02f5705d32f","resolution":{"observed_at":"2026-08-15T20:21:22.705935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00560","last_updated":"2024-03-31T04:44:22Z","snapshot_observed_at":"2026-08-16T14:04:55.067577Z","submitted_at":"2024-03-31T04:44:22Z","title":"A Theory for Length Generalization in Learning to Reason","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00560","snapshot_observed_at":"2026-08-15T20:21:21.392565Z","title":"A theory for length generalization in learning to reason,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.392565Z"},"links":{"cited_paper":"/paper/2404.00560","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:85a38f0ee1c4ce1254df70500f407eff9efe3f7ccb362f7c3b1180d7aaeb3e14","observation_id":"a2220d59-52cb-436f-958a-b96f09b19ac1","resolution":{"observed_at":"2026-08-15T20:21:21.392565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.682665Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering,","venue":null,"work_id":"a128ef54-34bf-4e69-8a1e-89f357e4d9e3","year":2018},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.397604Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:62cdd12ee862acdb739c8637ef1fbe2488715a3abcc591b0da7a6571b7caed3f","observation_id":"8af9e0f4-26d3-4839-84f6-40f71e44e48a","resolution":{"observed_at":"2026-08-15T20:21:22.688229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.665362Z","title":"Automatic chain of thought prompting in large language models,","venue":null,"work_id":"c646cfab-bd51-4835-b008-549863f87f14","year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.402244Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:506578fb5ee7cf45354ce2b9d149fa41e7f1fb53db1d91836b9c656f3970328b","observation_id":"ecc28a83-a663-4213-b071-589959c9b43b","resolution":{"observed_at":"2026-08-15T20:21:22.670802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-15T20:21:21.406841Z","title":"Self-consistency improves chain of thought reasoning in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.406841Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:91a96483b2ff5fcb4bbef12cb35f831f779449e950d108ac683c2c2b7ef236eb","observation_id":"93dccbdb-cef7-4f61-9436-fa02e32849aa","resolution":{"observed_at":"2026-08-15T20:21:21.406841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.648483Z","title":"Syn- thetic prompting: Generating chain-of-thought demonstrations for large language models,","venue":null,"work_id":"9aa58ec2-7e1d-4222-bb29-c0491fcacbc5","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.411935Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:75fe124b7ae3694c637b8c284e884fb4fc2657ca27c77a6742c81dc58f9e241e","observation_id":"3da3e9ea-3069-4d3f-aba3-e2bb96432c7f","resolution":{"observed_at":"2026-08-15T20:21:22.653702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.416387Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.416387Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:e36803f048f7c30a599c6044e2a39269a6240c574a192637c49f8ca2b2425a86","observation_id":"d6fe5ad0-757f-4a7d-b894-07ffcdbf09a1","resolution":{"observed_at":"2026-08-15T20:21:21.416387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.421129Z","title":"Program of thoughts prompting: Disentangling computation from reasoning for numerical reasoning tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.421129Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:093deeb8d548b7fe5792b3b1a32ed3e2b0724f95c6e6e0e6edf9ae6300ddd9b3","observation_id":"1706d942-a806-436f-b9a0-836a49d8482c","resolution":{"observed_at":"2026-08-15T20:21:21.421129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09014","last_updated":"2023-03-16T01:04:45Z","snapshot_observed_at":"2026-08-12T13:57:51.698262Z","submitted_at":"2023-03-16T01:04:45Z","title":"ART: Automatic multi-step reasoning and tool-use for large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09014","snapshot_observed_at":"2026-08-15T20:21:21.425795Z","title":"Art: Automatic multi-step reasoning and tool-use for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.425795Z"},"links":{"cited_paper":"/paper/2303.09014","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:ced32707af1d090ff73a70583f79963f67612986e681edafa818509cb96e5a13","observation_id":"1a42cffb-e4f8-4229-92ff-91f22c8b673a","resolution":{"observed_at":"2026-08-15T20:21:21.425795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04925","last_updated":"2024-06-22T08:18:48Z","snapshot_observed_at":"2026-08-16T14:28:38.790470Z","submitted_at":"2024-01-10T04:37:38Z","title":"The Impact of Reasoning Step Length on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04925","snapshot_observed_at":"2026-08-15T20:21:21.430667Z","title":"The impact of reasoning step length on large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.430667Z"},"links":{"cited_paper":"/paper/2401.04925","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:6c77d5d52f542f50974fba609bbd1eb12350b96b1a0e8c445dad3c4a6c367f0c","observation_id":"c8bfe22a-26d3-4d09-a77b-4fa1030fd3f5","resolution":{"observed_at":"2026-08-15T20:21:21.430667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.609143Z","title":"Complexity- based prompting for multi-step reasoning,","venue":null,"work_id":"2570f7e5-6eff-4a0e-b52f-d2bfcd9cc94d","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.435804Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:8becd40faa1523ac3020ce8cf4e4c4da8b0167c46e5c75861f3d1dc4dbb1c0f1","observation_id":"4eae0719-5b51-469e-add7-502bb8bccc31","resolution":{"observed_at":"2026-08-15T20:21:22.614395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18507","last_updated":"2023-10-07T08:07:46Z","snapshot_observed_at":"2026-08-16T15:28:38.697472Z","submitted_at":"2023-05-29T15:14:09Z","title":"Code Prompting: a Neural Symbolic Method for Complex Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18507","snapshot_observed_at":"2026-08-15T20:21:21.440371Z","title":"Code prompting: a neural symbolic method for complex reasoning in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.440371Z"},"links":{"cited_paper":"/paper/2305.18507","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:e63ef64cd84841050a5b65e97665e2666dbe6ac2f9ad7f6a8c5f872f7d86295d","observation_id":"6e7ac507-170d-43a2-aab1-f5b9d1f496a0","resolution":{"observed_at":"2026-08-15T20:21:21.440371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10573","last_updated":"2025-05-19T17:36:27Z","snapshot_observed_at":"2026-08-16T17:44:38.807101Z","submitted_at":"2025-03-13T17:23:45Z","title":"Evaluating Mathematical Reasoning Across Large Language Models: A Fine-Grained Approach","version":2},"cited_work":{"arxiv_id":"2503.10573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.10573","snapshot_observed_at":"2026-08-15T20:21:21.909312Z","title":"Evaluating Mathematical Reasoning Across Large Language Models: A Fine-Grained Approach","venue":"cs.LG","work_id":"f6996284-0adb-4742-900a-170d068ad878","year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.445226Z"},"links":{"cited_paper":"/paper/2503.10573","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:6b8f45c3f25ba46199a6039a892d96bfbcd4df2b4382250c321edad2cbc0d6e6","observation_id":"eec7229e-829b-45a6-b4e4-517b700783b3","resolution":{"observed_at":"2026-08-15T20:21:21.914159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.591991Z","title":"Deeplogic: Joint learning of neural perception and logical reasoning,","venue":null,"work_id":"a9a205fe-66a1-4e45-b1d4-27513d7ce3dc","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.450212Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:32a075f5e38b9376366f40bd03295a1ca740e77f042f445b0bc6b4371dd17d20","observation_id":"d8161538-c5c5-4e81-a6c0-325ed28ca14f","resolution":{"observed_at":"2026-08-15T20:21:22.597355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.574647Z","title":"Visual reasoning: From state to transformation,","venue":null,"work_id":"40e4a134-f6f7-42da-868e-4085e47e43b4","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.454594Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:da3c1b2b22c520d0417601921f5e925bc7868476b5d8715e1fe01795e760a9ed","observation_id":"91acedea-eb14-4a88-b070-cef0725c39e7","resolution":{"observed_at":"2026-08-15T20:21:22.580306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.557714Z","title":"Least-to-most prompting enables complex reasoning in large language models,","venue":null,"work_id":"dc2c4622-3205-44d9-8fb1-7668d3b19795","year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.458742Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:c87e3d3e1c8af13ea04439c3d8165c26222a0a5424edf4650c698300f6abafb7","observation_id":"5dbd45f4-b132-46bc-a800-7e81ac4c60dd","resolution":{"observed_at":"2026-08-15T20:21:22.562645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.542006Z","title":"Language models are greedy reasoners: A systematic formal analysis of chain-of-thought,","venue":null,"work_id":"2973862f-c85d-466e-95e9-ec06b0e22f85","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.462743Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:594714eb6e909d4b9c85c31dd04e213f224c0e54f19557974f4348807dee068b","observation_id":"33c31c42-54f4-403b-bf9a-140ba84c37f2","resolution":{"observed_at":"2026-08-15T20:21:22.546874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.526796Z","title":"Solving math word problems by combining language models with symbolic solvers,","venue":null,"work_id":"a4f16bfd-1459-4524-8834-d4c92277bf78","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.466645Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:4655ff8c6a393845a2c9563488e3bd13b65869ff71d836b46b98e967d16310de","observation_id":"9a0624fe-3420-4e86-b4e8-afb43bf5a852","resolution":{"observed_at":"2026-08-15T20:21:22.531668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14812","last_updated":"2025-03-13T03:03:57Z","snapshot_observed_at":"2026-08-16T13:58:38.141062Z","submitted_at":"2024-04-23T07:50:00Z","title":"Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns","version":2},"cited_work":{"arxiv_id":"2404.14812","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.14812","snapshot_observed_at":"2026-08-15T20:21:21.883783Z","title":"Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns","venue":"cs.CL","work_id":"47516f3d-edc8-4fc5-be39-60d3b9fae6a3","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.471065Z"},"links":{"cited_paper":"/paper/2404.14812","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:e07ed3283753d6ecc48dc456d83c42f9545a37fc4d0814245787da99207676ab","observation_id":"3f4f2844-ea06-4332-ae3e-71d25d3951d9","resolution":{"observed_at":"2026-08-15T20:21:21.890720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18272","last_updated":"2024-02-28T12:04:05Z","snapshot_observed_at":"2026-08-16T14:14:33.771779Z","submitted_at":"2024-02-28T12:04:05Z","title":"Rethinking the Bounds of LLM Reasoning: Are Multi-Agent Discussions the Key?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18272","snapshot_observed_at":"2026-08-15T20:21:21.475688Z","title":"Rethinking the bounds of llm reasoning: Are multi-agent discussions the key?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.475688Z"},"links":{"cited_paper":"/paper/2402.18272","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:6db530c65af666747098b7d30cea200d832716773324d88fa9ada725c927375d","observation_id":"a9aaef12-ac45-479d-b354-45fd53355a8f","resolution":{"observed_at":"2026-08-15T20:21:21.475688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.512223Z","title":"Why think step by step? reasoning emerges from the locality of experience,","venue":null,"work_id":"6e802192-c248-4127-98e1-ef369a15284f","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.480547Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:736d70e3aee6ff4f1ebc1576f2d9c863c08f68d1c5cf628b48b97c2dbde50081","observation_id":"fac18694-a8f3-4096-aac8-de63bc49eee0","resolution":{"observed_at":"2026-08-15T20:21:22.516888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.497706Z","title":"Can language models learn from explanations in context?","venue":null,"work_id":"3b9183ab-ee48-4563-ad4b-00b24343820b","year":2022},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.484990Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:1d17e7b9203e02035593de57dfcf76b224c1ad96e73aeed4cf7963e79221acf3","observation_id":"abc3f7af-00fe-439f-a39d-3741695a2d1e","resolution":{"observed_at":"2026-08-15T20:21:22.502242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.480169Z","title":"Causal abstraction for chain-of-thought reasoning in arithmetic word problems,","venue":null,"work_id":"5a013d1b-7a72-4802-b4f2-86ce8f77a3f1","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.489267Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:80cfc512ae8a6f148da5d502283900074593e732af9ec76fb8c2cd39329125d2","observation_id":"6cbc35b0-be91-4a20-901f-55eb26efbc18","resolution":{"observed_at":"2026-08-15T20:21:22.486111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.461789Z","title":"How large language models implement chain-of-thought?","venue":null,"work_id":"c5d5e5a5-cf72-4f24-bc37-f46910fb0cd9","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.493696Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:29ba4da86853945a1779edf30dd1dae4d151f806a8bf9de9c5a851dd4cf127fe","observation_id":"809c5d0c-d3fd-4808-9ff4-f1e4e751b450","resolution":{"observed_at":"2026-08-15T20:21:22.467707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.442654Z","title":"How does gpt-2 compute greater- than?: Interpreting mathematical abilities in a pre-trained language model,","venue":null,"work_id":"3dbeadab-fba5-4b13-b12a-df64c834f895","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.498150Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:b8371e185fe35a2cde11488f597968223aeace7ff3db320f15139c470d071f88","observation_id":"89d09452-9618-4791-b2fc-757c1c014dfc","resolution":{"observed_at":"2026-08-15T20:21:22.448192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18312","last_updated":"2024-05-06T09:16:15Z","snapshot_observed_at":"2026-08-16T14:14:32.681492Z","submitted_at":"2024-02-28T13:14:20Z","title":"How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18312","snapshot_observed_at":"2026-08-15T20:21:21.502333Z","title":"How to think step-by-step: A mechanistic understanding of chain-of-thought reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.502333Z"},"links":{"cited_paper":"/paper/2402.18312","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:3270b516a79d38bde68e1719e47fed9c24a26e99c26fed0ce20ed027d3b38ecc","observation_id":"c4d171ad-b657-44b4-a946-e4044de430a8","resolution":{"observed_at":"2026-08-15T20:21:21.502333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11807","last_updated":"2025-03-06T18:58:23Z","snapshot_observed_at":"2026-08-16T14:08:47.375155Z","submitted_at":"2024-03-18T14:04:47Z","title":"How Far Are We on the Decision-Making of LLMs? Evaluating LLMs' Gaming Ability in Multi-Agent Environments","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11807","snapshot_observed_at":"2026-08-15T20:21:21.506932Z","title":"How far are we on the decision-making of llms? evaluating llms’ gaming ability in multi-agent environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.506932Z"},"links":{"cited_paper":"/paper/2403.11807","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:f0757d450d44b4f013852210ccf4e4e95d2a068d9f376f86755228f510832117","observation_id":"0e6804b6-ad95-42e0-9e85-bb1e148cf328","resolution":{"observed_at":"2026-08-15T20:21:21.506932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.511003Z","title":"Ecm: A unified electronic circuit model for explaining the emergence of in-context learning and chain-of-thought in large language model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.511003Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:be411958e387b2c4feefdf5012533fda5e68e6adaead9372bae55d51e60eae2d","observation_id":"e4422bbb-35de-4366-b91e-d7dd04c01fcc","resolution":{"observed_at":"2026-08-15T20:21:21.511003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.426361Z","title":"The expressive power of transformers with chain of thought,","venue":null,"work_id":"a6416167-f105-409e-a6a0-4f3d7bf31dfc","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.515126Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:f874dba76ed004a4faf888cdd4476d1e2aa299e50001713eae8803e2f6b6a26e","observation_id":"6c5601b9-b66b-4e40-a712-5adeac652526","resolution":{"observed_at":"2026-08-15T20:21:22.431455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.409232Z","title":"Chain of thought empowers transformers to solve inherently serial problems,","venue":null,"work_id":"72461570-6a73-4289-a05b-4a1bb3b4c2d9","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.519477Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:40393b14da7aee7ad23b4d62cc7353ccf7ca418075fd6835505f1ee77ef32d35","observation_id":"3657318b-d9a5-4f3b-943d-8a283bf47a00","resolution":{"observed_at":"2026-08-15T20:21:22.414728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T20:21:21.523935Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.523935Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:650145229d42c14c1c9de3cb47acf7c7f28e47b1888b6278453ce739c12e97cc","observation_id":"b6c21fb5-8a81-45e0-8bc5-a653661c826f","resolution":{"observed_at":"2026-08-15T20:21:21.523935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T20:21:21.528383Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.528383Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:2737614b7c9e1830941cab05af447284b22d44ac69f0d4e54e8e0584304870cf","observation_id":"9837ff25-e801-42e9-b260-5f61e143ab82","resolution":{"observed_at":"2026-08-15T20:21:21.528383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.393469Z","title":"Llama 3,","venue":null,"work_id":"a1ac15d1-35ff-4501-b71c-ab7b19eb3c36","year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.533529Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:3a2a48acb00b553d9eb592c445822ca061e16b2f3cfbf3eed4ec667139385a7c","observation_id":"63df93b5-353c-4c19-8675-58384580d161","resolution":{"observed_at":"2026-08-15T20:21:22.398308Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-13T04:25:38.282910Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-15T20:21:21.537726Z","title":"Code llama: Open foundation models for code,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.537726Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:ed5dc4a9211ee1c53a14338c8b279da109baa0c446d94e1940be58b05d68a1de","observation_id":"e435b857-0623-4042-90e2-9820da970921","resolution":{"observed_at":"2026-08-15T20:21:21.537726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T20:21:21.542697Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.542697Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:ded961186c4dc83c7f668dcc6472077cf5ef3ce7d57b78dc0da1f01a9e7560f2","observation_id":"0c5681fb-7bd0-490d-9925-2191feba6bff","resolution":{"observed_at":"2026-08-15T20:21:21.542697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-15T20:21:21.547357Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.547357Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:610adeff0b5f5c236a66061215614205b7c20e3a1ac690b15268c0e5fddd1301","observation_id":"51188fee-a977-4d7b-b6a9-612d0a0611eb","resolution":{"observed_at":"2026-08-15T20:21:21.547357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:21.552145Z","title":"The claude 3 model family: Opus, sonnet, haiku,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.552145Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:b1048d3568692f88c10e959dc953e525b631f50798cbcaecbca3ca8d50e69bfe","observation_id":"5ec65144-9775-4e99-a5a1-5b7f09419b66","resolution":{"observed_at":"2026-08-15T20:21:21.552145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-16T19:40:28.523700Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:21:21.557087Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.557087Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:05cbaab35ce91adc1241acde23cbc6862c326be60922c7ee1405a13bdba7e56c","observation_id":"f6a23701-52df-430f-a511-13b4fc18abfa","resolution":{"observed_at":"2026-08-15T20:21:21.557087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.366590Z","title":"Mammoth: Building math generalist models through hybrid instruction tuning,","venue":null,"work_id":"1f5f6c5d-7fed-4d83-a338-53ac50612ff5","year":2023},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.562261Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:580be9667cca472c3951c1dc5edf34e1b09b41c1b8ee26488c87bd8d6e88b6e6","observation_id":"2d741793-2a04-495f-8fe8-5f45f8d96a22","resolution":{"observed_at":"2026-08-15T20:21:22.371688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10176","last_updated":"2024-11-03T03:48:02Z","snapshot_observed_at":"2026-08-16T17:24:49.433939Z","submitted_at":"2024-02-15T18:26:11Z","title":"OpenMathInstruct-1: A 1.8 Million Math Instruction Tuning Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10176","snapshot_observed_at":"2026-08-15T20:21:21.566759Z","title":"Openmathinstruct-1: A 1.8 million math instruction tuning dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.566759Z"},"links":{"cited_paper":"/paper/2402.10176","citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:50bc056cf7c784f79d2c7b8d9335377d6b1875a35a50fc255f3fed1d68b359e8","observation_id":"dac958e1-052f-40cb-b0e9-838211590ea5","resolution":{"observed_at":"2026-08-15T20:21:21.566759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.351263Z","title":"That is, the difficultyD(t 1, t2)satisfies: D(t1, t2|m) =D(t 1|m) +D(t 2|m) =K 1 +K 2,(14) where, K1, K2 denotes the relevant constants","venue":null,"work_id":"1e54c968-a0a3-44b2-b36c-b93b7a741d51","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.571504Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:faf33bbfb0d47c36b94f82c7d97d4465e1f851b819d83e31b35cc391ae498ee4","observation_id":"c64afb5a-edfe-4a81-b05d-30ce3edaeed3","resolution":{"observed_at":"2026-08-15T20:21:22.356321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.335071Z","title":"Proof.Following Eq","venue":null,"work_id":"eceb6670-3f12-4ddc-b88a-29dae256b99a","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.576096Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:33cccc2a414090dbc206b4e8534cae1b785cdf2ea3b4e0554e6b18f12ebe4d2f","observation_id":"86202f59-eda9-49de-b0ad-99ffefaa963b","resolution":{"observed_at":"2026-08-15T20:21:22.340411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.318658Z","title":"The prompt provided to the model is: Generate a scenario-related template involving multiple mathematical steps to solve a real-world problem","venue":null,"work_id":"0cd1c4fb-6c31-43e8-9753-f4ff88de7e92","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.580986Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:35a7622c7690cddb45276a3545e8ac45dea3d9d20c40475808088c5728f8525a","observation_id":"0918a7b2-9f74-4bc3-925c-50102f2e6bc8","resolution":{"observed_at":"2026-08-15T20:21:22.324113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.302885Z","title":"To facilitate the generation of extended sequences, we decompose the templates into smaller, loopable segments that incrementally meet the multi- step reasoning demands","venue":null,"work_id":"384c22fd-5bda-4e5a-b83e-d309bd8b756b","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.585926Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:571cb0668edb09bea39d9a8cc53bfac987e7f22056e5021287c8923a2ad3858f","observation_id":"2750336f-42a4-4b83-aa85-cf9078fd4f7c","resolution":{"observed_at":"2026-08-15T20:21:22.307843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.287524Z","title":null,"venue":null,"work_id":"7b5839d5-64bf-4231-b565-d96eb251c3c3","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.590553Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:2f944f46b151b5d8c62e3b636b2aaf4fabb79f8ad1da8275025a2743bbcf19b4","observation_id":"15648ec3-164c-4c1d-997a-02c78d9261a6","resolution":{"observed_at":"2026-08-15T20:21:22.291750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.271603Z","title":"This step evaluates the models’ performance across a broad range of numerical challenges","venue":null,"work_id":"f26e4fc0-de79-471d-95d3-25746d84efb3","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.595175Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:77f03b3cdc1ac170f5751bfc8bea9c8ab9248977c87c80d422269f7154060b1b","observation_id":"1c6e51a6-b1f1-45db-ba94-dfd3e84768b8","resolution":{"observed_at":"2026-08-15T20:21:22.276695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.256048Z","title":"Three experts were then hired to assess whether the samples were correct","venue":null,"work_id":"52abd1b6-264e-45cb-9779-58e35de3e29f","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.600568Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:be8428cc17a10d1b0dbd96cecc54701dbfb634069614c6092aa1bf699a1a39ed","observation_id":"648eb547-b64b-4f3c-88ae-bf8a9baebe0d","resolution":{"observed_at":"2026-08-15T20:21:22.261081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.240050Z","title":null,"venue":null,"work_id":"4d372f4f-b981-4020-b844-80b5d0646bc0","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.606682Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:8f6b95fc3c753ad64d370a13c03eb2d56be2ed4aa603733c8dd63667ce193dea","observation_id":"c3327177-73e6-4196-a246-b100ec8bafa5","resolution":{"observed_at":"2026-08-15T20:21:22.244258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:21:22.118272Z","title":"You should break down the task into manageable steps (less than 15 steps) within your capabilities but always consider the broader objective to ensure coherence in the approach","venue":null,"work_id":"ce28fd72-050a-4274-8ba3-60b38e06dfc1","year":null},"citing_paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T20:21:21.611008Z"},"links":{"citing_paper":"/paper/2505.13307"},"observation_digest":"sha256:2618d5ce5bee5e589a5d51b01899a1daf7ed48ba0ca358efed2c0b62581aa65b","observation_id":"3caab6d0-64c3-4ecf-ac63-0b9443da5bee","resolution":{"observed_at":"2026-08-15T20:21:22.186408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.13307","last_updated":"2025-05-19T16:25:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T01:20:04.725929Z","submitted_at":"2025-05-19T16:25:55Z","title":"RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":31,"verified_exact":2,"verified_fuzzy":39},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 4 inbound Pith citation observations for arXiv:2505.13307."}