{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:XSBXDSVYO4HEYHTJDC2HJMT4KN","short_pith_number":"pith:XSBXDSVY","schema_version":"1.0","canonical_sha256":"bc8371cab8770e4c1e6918b474b27c534c13b5d673582e3e1f6330ef79a64591","source":{"kind":"arxiv","id":"2507.14393","version":1},"attestation_state":"computed","paper":{"title":"Adaptive Multi-Agent Reasoning via Automated Workflow Generation","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.AI","authors_text":"Humza Sami, Mubashir ul Islam, Pierre-Emmanuel Gaillardon, Valerio Tenace","submitted_at":"2025-07-18T22:46:27Z","abstract_excerpt":"The rise of Large Reasoning Models (LRMs) promises a significant leap forward in language model capabilities, aiming to tackle increasingly sophisticated tasks with unprecedented efficiency and accuracy. However, despite their impressive performance, recent studies have highlighted how current reasoning models frequently fail to generalize to novel, unseen problems, often resorting to memorized solutions rather than genuine inferential reasoning. Such behavior underscores a critical limitation in modern LRMs, i.e., their tendency toward overfitting, which in turn results in poor generalization"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2507.14393","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.AI","submitted_at":"2025-07-18T22:46:27Z","cross_cats_sorted":[],"title_canon_sha256":"13286f147078e7af390d0762a92b931634011cc92863bd380d7ae73b46f2484e","abstract_canon_sha256":"d7d7acd7fc3dd588ec4314a06bd3d6de0fd650a407c6aa2ff4f2e9cfe3f90112"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:40:05.466958Z","signature_b64":"8104aHAP4+/abYSUA4fYtmE0kwuSBN64TQvWGUWX1dsHpXas2ArZnWIqVfBorbL97sS+4AH/YrFV5ljQts61Cg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"bc8371cab8770e4c1e6918b474b27c534c13b5d673582e3e1f6330ef79a64591","last_reissued_at":"2026-07-05T11:40:05.466470Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:40:05.466470Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Adaptive Multi-Agent Reasoning via Automated Workflow Generation","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.AI","authors_text":"Humza Sami, Mubashir ul Islam, Pierre-Emmanuel Gaillardon, Valerio Tenace","submitted_at":"2025-07-18T22:46:27Z","abstract_excerpt":"The rise of Large Reasoning Models (LRMs) promises a significant leap forward in language model capabilities, aiming to tackle increasingly sophisticated tasks with unprecedented efficiency and accuracy. However, despite their impressive performance, recent studies have highlighted how current reasoning models frequently fail to generalize to novel, unseen problems, often resorting to memorized solutions rather than genuine inferential reasoning. Such behavior underscores a critical limitation in modern LRMs, i.e., their tendency toward overfitting, which in turn results in poor generalization"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.14393","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2507.14393/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2507.14393","created_at":"2026-07-05T11:40:05.466531+00:00"},{"alias_kind":"arxiv_version","alias_value":"2507.14393v1","created_at":"2026-07-05T11:40:05.466531+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.14393","created_at":"2026-07-05T11:40:05.466531+00:00"},{"alias_kind":"pith_short_12","alias_value":"XSBXDSVYO4HE","created_at":"2026-07-05T11:40:05.466531+00:00"},{"alias_kind":"pith_short_16","alias_value":"XSBXDSVYO4HEYHTJ","created_at":"2026-07-05T11:40:05.466531+00:00"},{"alias_kind":"pith_short_8","alias_value":"XSBXDSVY","created_at":"2026-07-05T11:40:05.466531+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.07539","citing_title":"Prompt Governance? On Governing Technologies Governed by Natural Language","ref_index":297,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN","json":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN.json","graph_json":"https://pith.science/api/pith-number/XSBXDSVYO4HEYHTJDC2HJMT4KN/graph.json","events_json":"https://pith.science/api/pith-number/XSBXDSVYO4HEYHTJDC2HJMT4KN/events.json","paper":"https://pith.science/paper/XSBXDSVY"},"agent_actions":{"view_html":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN","download_json":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN.json","view_paper":"https://pith.science/paper/XSBXDSVY","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2507.14393&json=true","fetch_graph":"https://pith.science/api/pith-number/XSBXDSVYO4HEYHTJDC2HJMT4KN/graph.json","fetch_events":"https://pith.science/api/pith-number/XSBXDSVYO4HEYHTJDC2HJMT4KN/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN/action/timestamp_anchor","attest_storage":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN/action/storage_attestation","attest_author":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN/action/author_attestation","sign_citation":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN/action/citation_signature","submit_replication":"https://pith.science/pith/XSBXDSVYO4HEYHTJDC2HJMT4KN/action/replication_record"}},"created_at":"2026-07-05T11:40:05.466531+00:00","updated_at":"2026-07-05T11:40:05.466531+00:00"}