{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2025:PQJ73JLMEZZ42DNH5GA2HGTN53","short_pith_number":"pith:PQJ73JLM","canonical_record":{"source":{"id":"2507.00711","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-07-01T12:14:22Z","cross_cats_sorted":[],"title_canon_sha256":"6dc84c48de4a93e22f685e07ba9e90922ba99736707c9186c9af7ffaa33e8b2b","abstract_canon_sha256":"a5bad1911fd1c0c6435df51df0b7eef1b141371bd29b0a525b901d698139ac5e"},"schema_version":"1.0"},"canonical_sha256":"7c13fda56c2673cd0da7e981a39a6deef4bbfbc4017cf5d3d057a06ca10ce45c","source":{"kind":"arxiv","id":"2507.00711","version":1},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2507.00711","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"arxiv_version","alias_value":"2507.00711v1","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.00711","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_12","alias_value":"PQJ73JLMEZZ4","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_16","alias_value":"PQJ73JLMEZZ42DNH","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_8","alias_value":"PQJ73JLM","created_at":"2026-07-05T11:30:13Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2025:PQJ73JLMEZZ42DNH5GA2HGTN53","target":"record","payload":{"canonical_record":{"source":{"id":"2507.00711","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-07-01T12:14:22Z","cross_cats_sorted":[],"title_canon_sha256":"6dc84c48de4a93e22f685e07ba9e90922ba99736707c9186c9af7ffaa33e8b2b","abstract_canon_sha256":"a5bad1911fd1c0c6435df51df0b7eef1b141371bd29b0a525b901d698139ac5e"},"schema_version":"1.0"},"canonical_sha256":"7c13fda56c2673cd0da7e981a39a6deef4bbfbc4017cf5d3d057a06ca10ce45c","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:30:13.353916Z","signature_b64":"eKj3UIVTSlU4yxKEL8FG1RW3MfWznUOg0n7bsgarb1BDz1RdnlWz5dTrI+n2VoN5aAZN5lPfMP1hLMv8PA6zDQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"7c13fda56c2673cd0da7e981a39a6deef4bbfbc4017cf5d3d057a06ca10ce45c","last_reissued_at":"2026-07-05T11:30:13.353448Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:30:13.353448Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2507.00711","source_version":1,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T11:30:13Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"n18Y2fVf8TnSEFCsPt50rAYt6CeEgY7tUG60CoYB9wI/2yKln1+70jySOKLAvDtN52pguk5uLuI8/5fjfNfjDQ==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-07T18:29:33.802947Z"},"content_sha256":"41d065ce4855e946e0377f1ae2b70d72bbce2333668104c8d9da1f01e124d2a7","schema_version":"1.0","event_id":"sha256:41d065ce4855e946e0377f1ae2b70d72bbce2333668104c8d9da1f01e124d2a7"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2025:PQJ73JLMEZZ42DNH5GA2HGTN53","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Jhouben Cuesta-Ramirez, Mehdi Mounsif, Samuel Beaussant","submitted_at":"2025-07-01T12:14:22Z","abstract_excerpt":"Large Language Models (LLMs) trained via Reinforcement Learning (RL) have recently achieved impressive results on reasoning benchmarks. Yet, growing evidence shows that these models often generate longer but ineffective chains of thought (CoTs), calling into question whether benchmark gains reflect real reasoning improvements. We present new evidence of overthinking, where models disregard correct solutions even when explicitly provided, instead continuing to generate unnecessary reasoning steps that often lead to incorrect conclusions. Experiments on three state-of-the-art models using the AI"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.00711","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2507.00711/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T11:30:13Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"JtKFnx11x2QzAdP70FX/oVjLTy31yROFJS6Cw2HXo5eot3jF4zY1u1LskWnEFtN5OXgJ/N/a6VlQPqv2ra3UCw==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-07T18:29:33.803386Z"},"content_sha256":"d66464428729230c3ad7085555e350e8bc6d751adddbbf4e359c3ec15b9656ea","schema_version":"1.0","event_id":"sha256:d66464428729230c3ad7085555e350e8bc6d751adddbbf4e359c3ec15b9656ea"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/bundle.json","state_url":"https://pith.science/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-07T18:29:33Z","links":{"resolver":"https://pith.science/pith/PQJ73JLMEZZ42DNH5GA2HGTN53","bundle":"https://pith.science/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/bundle.json","state":"https://pith.science/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/state.json","well_known_bundle":"https://pith.science/.well-known/pith/PQJ73JLMEZZ42DNH5GA2HGTN53/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2025:PQJ73JLMEZZ42DNH5GA2HGTN53","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"a5bad1911fd1c0c6435df51df0b7eef1b141371bd29b0a525b901d698139ac5e","cross_cats_sorted":[],"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-07-01T12:14:22Z","title_canon_sha256":"6dc84c48de4a93e22f685e07ba9e90922ba99736707c9186c9af7ffaa33e8b2b"},"schema_version":"1.0","source":{"id":"2507.00711","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2507.00711","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"arxiv_version","alias_value":"2507.00711v1","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.00711","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_12","alias_value":"PQJ73JLMEZZ4","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_16","alias_value":"PQJ73JLMEZZ42DNH","created_at":"2026-07-05T11:30:13Z"},{"alias_kind":"pith_short_8","alias_value":"PQJ73JLM","created_at":"2026-07-05T11:30:13Z"}],"graph_snapshots":[{"event_id":"sha256:d66464428729230c3ad7085555e350e8bc6d751adddbbf4e359c3ec15b9656ea","target":"graph","created_at":"2026-07-05T11:30:13Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2507.00711/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Large Language Models (LLMs) trained via Reinforcement Learning (RL) have recently achieved impressive results on reasoning benchmarks. Yet, growing evidence shows that these models often generate longer but ineffective chains of thought (CoTs), calling into question whether benchmark gains reflect real reasoning improvements. We present new evidence of overthinking, where models disregard correct solutions even when explicitly provided, instead continuing to generate unnecessary reasoning steps that often lead to incorrect conclusions. Experiments on three state-of-the-art models using the AI","authors_text":"Jhouben Cuesta-Ramirez, Mehdi Mounsif, Samuel Beaussant","cross_cats":[],"headline":"","license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-07-01T12:14:22Z","title":"Large Reasoning Models are not thinking straight: on the unreliability of thinking trajectories"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.00711","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:41d065ce4855e946e0377f1ae2b70d72bbce2333668104c8d9da1f01e124d2a7","target":"record","created_at":"2026-07-05T11:30:13Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"a5bad1911fd1c0c6435df51df0b7eef1b141371bd29b0a525b901d698139ac5e","cross_cats_sorted":[],"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2025-07-01T12:14:22Z","title_canon_sha256":"6dc84c48de4a93e22f685e07ba9e90922ba99736707c9186c9af7ffaa33e8b2b"},"schema_version":"1.0","source":{"id":"2507.00711","kind":"arxiv","version":1}},"canonical_sha256":"7c13fda56c2673cd0da7e981a39a6deef4bbfbc4017cf5d3d057a06ca10ce45c","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"7c13fda56c2673cd0da7e981a39a6deef4bbfbc4017cf5d3d057a06ca10ce45c","first_computed_at":"2026-07-05T11:30:13.353448Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T11:30:13.353448Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"eKj3UIVTSlU4yxKEL8FG1RW3MfWznUOg0n7bsgarb1BDz1RdnlWz5dTrI+n2VoN5aAZN5lPfMP1hLMv8PA6zDQ==","signature_status":"signed_v1","signed_at":"2026-07-05T11:30:13.353916Z","signed_message":"canonical_sha256_bytes"},"source_id":"2507.00711","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:41d065ce4855e946e0377f1ae2b70d72bbce2333668104c8d9da1f01e124d2a7","sha256:d66464428729230c3ad7085555e350e8bc6d751adddbbf4e359c3ec15b9656ea"],"state_sha256":"6c000d14ac65f7cab4606cc9127a8e6b246e202338c77ec5d72c3f8dcdf01b13"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"EU0BI9nBaeFRSKv4KxW77o3kAtosK6mUtN4ZGbugZYeGjMIh8+TXeBC7uSMg2LsKtDbZPihkxFD6qdv7dSChCw==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-07T18:29:33.807082Z","bundle_sha256":"bda7f54b12109e08eb1300cb20a51e4929af128519acd9ad9ebbb7d6930c6c24"}}