{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2025:R7T733UK65Z44WA5GI2HTIF4N3","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"87c98ebb7c2e6147a0acba3ae3e58dc4abb941d95f5dcf3a7a2f7af200e3b86c","cross_cats_sorted":["cs.AI","cs.IT","cs.LG","cs.SY","eess.SY","math.IT"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2025-07-03T17:55:43Z","title_canon_sha256":"96cdf108bf797d797f98d4e88bcb1918a432957f9fde38b3a5068717c4cb3e7d"},"schema_version":"1.0","source":{"id":"2507.02851","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2507.02851","created_at":"2026-07-05T11:31:35Z"},{"alias_kind":"arxiv_version","alias_value":"2507.02851v1","created_at":"2026-07-05T11:31:35Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.02851","created_at":"2026-07-05T11:31:35Z"},{"alias_kind":"pith_short_12","alias_value":"R7T733UK65Z4","created_at":"2026-07-05T11:31:35Z"},{"alias_kind":"pith_short_16","alias_value":"R7T733UK65Z44WA5","created_at":"2026-07-05T11:31:35Z"},{"alias_kind":"pith_short_8","alias_value":"R7T733UK","created_at":"2026-07-05T11:31:35Z"}],"graph_snapshots":[{"event_id":"sha256:6d76d68d122e696aebf0e054f4ec55655554bb56600f5959dbcc3c5167b8b425","target":"graph","created_at":"2026-07-05T11:31:35Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2507.02851/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Recent advancements in the reasoning capabilities of large language models (LLMs) show that employing group relative policy optimization (GRPO) algorithm for reinforcement learning (RL) training allows the models to use more thinking/reasoning tokens for generating better responses. However, LLMs can generate only a finite amount of tokens while maintaining attention to the previously generated tokens. This limit, also known as the context size of an LLM, is a bottleneck in LLM reasoning with arbitrarily large number of tokens. To think beyond the limit of context size, an LLM must employ a mo","authors_text":"Purbesh Mitra, Sennur Ulukus","cross_cats":["cs.AI","cs.IT","cs.LG","cs.SY","eess.SY","math.IT"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2025-07-03T17:55:43Z","title":"MOTIF: Modular Thinking via Reinforcement Fine-tuning in LLMs"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.02851","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:07afd918e419aa2560848f6bc601c1a3f5b454180bd1c31ecfff79efb5c165ed","target":"record","created_at":"2026-07-05T11:31:35Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"87c98ebb7c2e6147a0acba3ae3e58dc4abb941d95f5dcf3a7a2f7af200e3b86c","cross_cats_sorted":["cs.AI","cs.IT","cs.LG","cs.SY","eess.SY","math.IT"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2025-07-03T17:55:43Z","title_canon_sha256":"96cdf108bf797d797f98d4e88bcb1918a432957f9fde38b3a5068717c4cb3e7d"},"schema_version":"1.0","source":{"id":"2507.02851","kind":"arxiv","version":1}},"canonical_sha256":"8fe7fdee8af773ce581d323479a0bc6ef0f1418ae5bd93ed576195c556dee4cc","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"8fe7fdee8af773ce581d323479a0bc6ef0f1418ae5bd93ed576195c556dee4cc","first_computed_at":"2026-07-05T11:31:35.317297Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T11:31:35.317297Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"j6DLjjiCqW+ykRW7US0+jxx1+6djla2K86z5rsvoqt2x6hmA648TuyfhzI6+jiRD2TP9SzP9mYSf0X2F/kO0Bw==","signature_status":"signed_v1","signed_at":"2026-07-05T11:31:35.317777Z","signed_message":"canonical_sha256_bytes"},"source_id":"2507.02851","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:07afd918e419aa2560848f6bc601c1a3f5b454180bd1c31ecfff79efb5c165ed","sha256:6d76d68d122e696aebf0e054f4ec55655554bb56600f5959dbcc3c5167b8b425"],"state_sha256":"ff7d8a93c05203493522022924768c1fe675e94a27a7a6042f5a0565292d35c8"}