{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2024:RXV4V2U7EAIUXLB5RTA7R5HBX6","short_pith_number":"pith:RXV4V2U7","canonical_record":{"source":{"id":"2407.13237","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2024-07-18T07:47:51Z","cross_cats_sorted":[],"title_canon_sha256":"188068002d607d48fb8e435a28087d20a720c7662060b2d2ebc7069788f9cd6d","abstract_canon_sha256":"fea5eac587702d6c2598b89562d4e3be328aae6d64eb286f650872d70cf4f636"},"schema_version":"1.0"},"canonical_sha256":"8debcaea9f20114bac3d8cc1f8f4e1bfb59b6e07092cf50895c59607f80e9225","source":{"kind":"arxiv","id":"2407.13237","version":1},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2407.13237","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"arxiv_version","alias_value":"2407.13237v1","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2407.13237","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_12","alias_value":"RXV4V2U7EAIU","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_16","alias_value":"RXV4V2U7EAIUXLB5","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_8","alias_value":"RXV4V2U7","created_at":"2026-07-05T08:45:36Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2024:RXV4V2U7EAIUXLB5RTA7R5HBX6","target":"record","payload":{"canonical_record":{"source":{"id":"2407.13237","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2024-07-18T07:47:51Z","cross_cats_sorted":[],"title_canon_sha256":"188068002d607d48fb8e435a28087d20a720c7662060b2d2ebc7069788f9cd6d","abstract_canon_sha256":"fea5eac587702d6c2598b89562d4e3be328aae6d64eb286f650872d70cf4f636"},"schema_version":"1.0"},"canonical_sha256":"8debcaea9f20114bac3d8cc1f8f4e1bfb59b6e07092cf50895c59607f80e9225","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:45:36.195421Z","signature_b64":"KsKeG1B0mea6JvbIelbiIcsk9kPIS0eXE+kK8pHCuNVnU0bVOJ7oxhFbhWeImjX+1mkpsMTOz3eYnv/gBo+nDw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"8debcaea9f20114bac3d8cc1f8f4e1bfb59b6e07092cf50895c59607f80e9225","last_reissued_at":"2026-07-05T08:45:36.195045Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:45:36.195045Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2407.13237","source_version":1,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T08:45:36Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"zZAJEPwqA0OqwjyiVZ09wf8L8BrF5CkQSJkBKrDP9hthezJH/ZRCIXmBIih+xXSGnTWkjs+gMjNO4fUx2IJxCA==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-05T01:23:53.304711Z"},"content_sha256":"0b9464a628406b34c597fb3b17c20c2f0a2941920b219479db03baa303929a90","schema_version":"1.0","event_id":"sha256:0b9464a628406b34c597fb3b17c20c2f0a2941920b219479db03baa303929a90"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2024:RXV4V2U7EAIUXLB5RTA7R5HBX6","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"LLM-Empowered State Representation for Reinforcement Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.AI","authors_text":"Boyuan Wang, Chang Liu, Jianzhun Shao, Wenming Yang, Xiangyang Ji, Yuhang Jiang, Yun Qu","submitted_at":"2024-07-18T07:47:51Z","abstract_excerpt":"Conventional state representations in reinforcement learning often omit critical task-related details, presenting a significant challenge for value networks in establishing accurate mappings from states to task rewards. Traditional methods typically depend on extensive sample learning to enrich state representations with task-specific information, which leads to low sample efficiency and high time costs. Recently, surging knowledgeable large language models (LLM) have provided promising substitutes for prior injection with minimal human intervention. Motivated by this, we propose LLM-Empowered"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2407.13237","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2407.13237/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T08:45:36Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"NH0tmD6eqD35N9NJIXICAUo0Xa3FV4yHRV584BSx4qYvsw3U3y3jCME9vCBFC8A2bW9gFmGDdVnROitNRffhBA==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-05T01:23:53.305678Z"},"content_sha256":"43bd25ac3a8f9fd79eda5849dd87ef97c0c6e32f19bdbde741f3ee2ab8c3b154","schema_version":"1.0","event_id":"sha256:43bd25ac3a8f9fd79eda5849dd87ef97c0c6e32f19bdbde741f3ee2ab8c3b154"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/bundle.json","state_url":"https://pith.science/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-05T01:23:53Z","links":{"resolver":"https://pith.science/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6","bundle":"https://pith.science/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/bundle.json","state":"https://pith.science/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/state.json","well_known_bundle":"https://pith.science/.well-known/pith/RXV4V2U7EAIUXLB5RTA7R5HBX6/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2024:RXV4V2U7EAIUXLB5RTA7R5HBX6","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"fea5eac587702d6c2598b89562d4e3be328aae6d64eb286f650872d70cf4f636","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2024-07-18T07:47:51Z","title_canon_sha256":"188068002d607d48fb8e435a28087d20a720c7662060b2d2ebc7069788f9cd6d"},"schema_version":"1.0","source":{"id":"2407.13237","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2407.13237","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"arxiv_version","alias_value":"2407.13237v1","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2407.13237","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_12","alias_value":"RXV4V2U7EAIU","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_16","alias_value":"RXV4V2U7EAIUXLB5","created_at":"2026-07-05T08:45:36Z"},{"alias_kind":"pith_short_8","alias_value":"RXV4V2U7","created_at":"2026-07-05T08:45:36Z"}],"graph_snapshots":[{"event_id":"sha256:43bd25ac3a8f9fd79eda5849dd87ef97c0c6e32f19bdbde741f3ee2ab8c3b154","target":"graph","created_at":"2026-07-05T08:45:36Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2407.13237/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Conventional state representations in reinforcement learning often omit critical task-related details, presenting a significant challenge for value networks in establishing accurate mappings from states to task rewards. Traditional methods typically depend on extensive sample learning to enrich state representations with task-specific information, which leads to low sample efficiency and high time costs. Recently, surging knowledgeable large language models (LLM) have provided promising substitutes for prior injection with minimal human intervention. Motivated by this, we propose LLM-Empowered","authors_text":"Boyuan Wang, Chang Liu, Jianzhun Shao, Wenming Yang, Xiangyang Ji, Yuhang Jiang, Yun Qu","cross_cats":[],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2024-07-18T07:47:51Z","title":"LLM-Empowered State Representation for Reinforcement Learning"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2407.13237","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:0b9464a628406b34c597fb3b17c20c2f0a2941920b219479db03baa303929a90","target":"record","created_at":"2026-07-05T08:45:36Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"fea5eac587702d6c2598b89562d4e3be328aae6d64eb286f650872d70cf4f636","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2024-07-18T07:47:51Z","title_canon_sha256":"188068002d607d48fb8e435a28087d20a720c7662060b2d2ebc7069788f9cd6d"},"schema_version":"1.0","source":{"id":"2407.13237","kind":"arxiv","version":1}},"canonical_sha256":"8debcaea9f20114bac3d8cc1f8f4e1bfb59b6e07092cf50895c59607f80e9225","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"8debcaea9f20114bac3d8cc1f8f4e1bfb59b6e07092cf50895c59607f80e9225","first_computed_at":"2026-07-05T08:45:36.195045Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T08:45:36.195045Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"KsKeG1B0mea6JvbIelbiIcsk9kPIS0eXE+kK8pHCuNVnU0bVOJ7oxhFbhWeImjX+1mkpsMTOz3eYnv/gBo+nDw==","signature_status":"signed_v1","signed_at":"2026-07-05T08:45:36.195421Z","signed_message":"canonical_sha256_bytes"},"source_id":"2407.13237","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:0b9464a628406b34c597fb3b17c20c2f0a2941920b219479db03baa303929a90","sha256:43bd25ac3a8f9fd79eda5849dd87ef97c0c6e32f19bdbde741f3ee2ab8c3b154"],"state_sha256":"fe1242d85061d10622bdeb1f9154cc60eda2d6727850034df2c9fdb55a242a11"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"lGAS6FD0oeXhBruyac0cA9tea32fhXy0o5HzD9l4+cpOZPxB1E5/Ye43cKHaehA6Q7RfNT3S6vunf+xGYzdLAw==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-05T01:23:53.309603Z","bundle_sha256":"b98780c3cec6c28fb8120adcbbc6c6a7deb0c42b6b73b1597a79334851ae4c13"}}