{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2026:DUP4VEODGOXOGW3656EBTDBIA3","short_pith_number":"pith:DUP4VEOD","canonical_record":{"source":{"id":"2607.06175","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2026-07-07T11:53:02Z","cross_cats_sorted":["cs.AI","cs.LG"],"title_canon_sha256":"2efeb2445f764c2305694cd25a2f2335d48a19aa159b21d40e809675c16508f0","abstract_canon_sha256":"5de6f1a4e6878137e57df3969f3f17ba1ea06e65940cfe8fbe22f3738a169f93"},"schema_version":"1.0"},"canonical_sha256":"1d1fca91c333aee35b7eef88198c2806d7885050b28e07cf3f5ca6b39fcc70ff","source":{"kind":"arxiv","id":"2607.06175","version":1},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2607.06175","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"arxiv_version","alias_value":"2607.06175v1","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2607.06175","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_12","alias_value":"DUP4VEODGOXO","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_16","alias_value":"DUP4VEODGOXOGW36","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_8","alias_value":"DUP4VEOD","created_at":"2026-07-08T01:19:16Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2026:DUP4VEODGOXOGW3656EBTDBIA3","target":"record","payload":{"canonical_record":{"source":{"id":"2607.06175","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2026-07-07T11:53:02Z","cross_cats_sorted":["cs.AI","cs.LG"],"title_canon_sha256":"2efeb2445f764c2305694cd25a2f2335d48a19aa159b21d40e809675c16508f0","abstract_canon_sha256":"5de6f1a4e6878137e57df3969f3f17ba1ea06e65940cfe8fbe22f3738a169f93"},"schema_version":"1.0"},"canonical_sha256":"1d1fca91c333aee35b7eef88198c2806d7885050b28e07cf3f5ca6b39fcc70ff","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-08T01:19:16.605740Z","signature_b64":"6ignU2eQTaRrf+7SISyuNJFdAqKFdN9/zQOmVduwgFltgDaBXYg7zuM7JvaECuvLxrqyra0Uzz0okrhUY1/HAQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"1d1fca91c333aee35b7eef88198c2806d7885050b28e07cf3f5ca6b39fcc70ff","last_reissued_at":"2026-07-08T01:19:16.605212Z","signature_status":"signed_v1","first_computed_at":"2026-07-08T01:19:16.605212Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2607.06175","source_version":1,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-08T01:19:16Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"OSVQ6nvH3FCamrAav6+tgfPEPqc1U5smCbdJX1+CPZyYGKZtQGwWLLeCNaNETRP4Rj5IxCto3u2ctXY101LWCg==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-07-26T13:04:58.469145Z"},"content_sha256":"a15756501bcc46f72da91907abff8ebc0d445d7f42981caec82483f761161ede","schema_version":"1.0","event_id":"sha256:a15756501bcc46f72da91907abff8ebc0d445d7f42981caec82483f761161ede"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2026:DUP4VEODGOXOGW3656EBTDBIA3","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"Improving LLM-Generated Process Model Quality Through Reinforcement Learning: The Role of Reward Function Design","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CL","authors_text":"Alexander Rombach, Chantale Lauer, Nijat Mehdiyev","submitted_at":"2026-07-07T11:53:02Z","abstract_excerpt":"Large language models (LLMs) can generate BPMN process models from natural-language descriptions, yet supervised fine-tuning (SFT) limits their output quality to the patterns present in the training data. Reinforcement learning (RL) can optimize beyond this ceiling using external quality measures, but how the reward function should be designed when quality is multi-dimensional remains unexplored. We present a systematic investigation of reward function design for RL-based process model generation, training two LLM families (Llama~3.1 8B, Qwen~2.5 14B) under 48 configurations using Group Sequen"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2607.06175","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2607.06175/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-08T01:19:16Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"U7qVk4Xb8e9ABADywRIVZGMdKEiWcfGQ0qFPaSFKefNjC/OcKh45otWDUInhIvNqhK9rYvKLdl1kTkec8J1UAA==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-07-26T13:04:58.469542Z"},"content_sha256":"95582e47dfba79e2fc5c27ae20ee598d76703801b724636f27517cc5353a877f","schema_version":"1.0","event_id":"sha256:95582e47dfba79e2fc5c27ae20ee598d76703801b724636f27517cc5353a877f"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/DUP4VEODGOXOGW3656EBTDBIA3/bundle.json","state_url":"https://pith.science/pith/DUP4VEODGOXOGW3656EBTDBIA3/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/DUP4VEODGOXOGW3656EBTDBIA3/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-07-26T13:04:58Z","links":{"resolver":"https://pith.science/pith/DUP4VEODGOXOGW3656EBTDBIA3","bundle":"https://pith.science/pith/DUP4VEODGOXOGW3656EBTDBIA3/bundle.json","state":"https://pith.science/pith/DUP4VEODGOXOGW3656EBTDBIA3/state.json","well_known_bundle":"https://pith.science/.well-known/pith/DUP4VEODGOXOGW3656EBTDBIA3/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2026:DUP4VEODGOXOGW3656EBTDBIA3","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"5de6f1a4e6878137e57df3969f3f17ba1ea06e65940cfe8fbe22f3738a169f93","cross_cats_sorted":["cs.AI","cs.LG"],"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2026-07-07T11:53:02Z","title_canon_sha256":"2efeb2445f764c2305694cd25a2f2335d48a19aa159b21d40e809675c16508f0"},"schema_version":"1.0","source":{"id":"2607.06175","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2607.06175","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"arxiv_version","alias_value":"2607.06175v1","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2607.06175","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_12","alias_value":"DUP4VEODGOXO","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_16","alias_value":"DUP4VEODGOXOGW36","created_at":"2026-07-08T01:19:16Z"},{"alias_kind":"pith_short_8","alias_value":"DUP4VEOD","created_at":"2026-07-08T01:19:16Z"}],"graph_snapshots":[{"event_id":"sha256:95582e47dfba79e2fc5c27ae20ee598d76703801b724636f27517cc5353a877f","target":"graph","created_at":"2026-07-08T01:19:16Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2607.06175/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Large language models (LLMs) can generate BPMN process models from natural-language descriptions, yet supervised fine-tuning (SFT) limits their output quality to the patterns present in the training data. Reinforcement learning (RL) can optimize beyond this ceiling using external quality measures, but how the reward function should be designed when quality is multi-dimensional remains unexplored. We present a systematic investigation of reward function design for RL-based process model generation, training two LLM families (Llama~3.1 8B, Qwen~2.5 14B) under 48 configurations using Group Sequen","authors_text":"Alexander Rombach, Chantale Lauer, Nijat Mehdiyev","cross_cats":["cs.AI","cs.LG"],"headline":"","license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2026-07-07T11:53:02Z","title":"Improving LLM-Generated Process Model Quality Through Reinforcement Learning: The Role of Reward Function Design"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2607.06175","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:a15756501bcc46f72da91907abff8ebc0d445d7f42981caec82483f761161ede","target":"record","created_at":"2026-07-08T01:19:16Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"5de6f1a4e6878137e57df3969f3f17ba1ea06e65940cfe8fbe22f3738a169f93","cross_cats_sorted":["cs.AI","cs.LG"],"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2026-07-07T11:53:02Z","title_canon_sha256":"2efeb2445f764c2305694cd25a2f2335d48a19aa159b21d40e809675c16508f0"},"schema_version":"1.0","source":{"id":"2607.06175","kind":"arxiv","version":1}},"canonical_sha256":"1d1fca91c333aee35b7eef88198c2806d7885050b28e07cf3f5ca6b39fcc70ff","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"1d1fca91c333aee35b7eef88198c2806d7885050b28e07cf3f5ca6b39fcc70ff","first_computed_at":"2026-07-08T01:19:16.605212Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-08T01:19:16.605212Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"6ignU2eQTaRrf+7SISyuNJFdAqKFdN9/zQOmVduwgFltgDaBXYg7zuM7JvaECuvLxrqyra0Uzz0okrhUY1/HAQ==","signature_status":"signed_v1","signed_at":"2026-07-08T01:19:16.605740Z","signed_message":"canonical_sha256_bytes"},"source_id":"2607.06175","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:a15756501bcc46f72da91907abff8ebc0d445d7f42981caec82483f761161ede","sha256:95582e47dfba79e2fc5c27ae20ee598d76703801b724636f27517cc5353a877f"],"state_sha256":"f5aa28fa5f6876ba6b97a28073ec7ce79f348bb6572b3b68448420140021a331"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"AAbzcekbqq8/9pUE5/1A6kzzy0XR/L9H733DCKFvt7UGMW1iSkQF9LWoCxIUmRl3vxpsOz/1tOLf1NXoD6hyBg==","signed_message":"bundle_sha256_bytes","signed_at":"2026-07-26T13:04:58.472118Z","bundle_sha256":"66a26b86d1240a23157f7f33bd7f3f690d6e71f403fb69376ce0e7f20c5a8d4a"}}