{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2024:FH4NLTNA6JFJJQVZXIN6SWREAC","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"f2b043a5fb3f666c402f43a0f212e0372e33c9a352e4fde5f41acca828bbf800","cross_cats_sorted":["cs.RO"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-03-22T10:05:21Z","title_canon_sha256":"974d25263e725f811c4b80d5af53328178166b715b60470669482dbca58ea804"},"schema_version":"1.0","source":{"id":"2403.15079","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2403.15079","created_at":"2026-07-05T07:59:30Z"},{"alias_kind":"arxiv_version","alias_value":"2403.15079v1","created_at":"2026-07-05T07:59:30Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2403.15079","created_at":"2026-07-05T07:59:30Z"},{"alias_kind":"pith_short_12","alias_value":"FH4NLTNA6JFJ","created_at":"2026-07-05T07:59:30Z"},{"alias_kind":"pith_short_16","alias_value":"FH4NLTNA6JFJJQVZ","created_at":"2026-07-05T07:59:30Z"},{"alias_kind":"pith_short_8","alias_value":"FH4NLTNA","created_at":"2026-07-05T07:59:30Z"}],"graph_snapshots":[{"event_id":"sha256:c9f2ee1bebfbb1c55fdc10e3c5692d0c2bd620e0b0053b371fbecd07698a7f62","target":"graph","created_at":"2026-07-05T07:59:30Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2403.15079/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Inverse reinforcement learning (IRL) is an imitation learning approach to learning reward functions from expert demonstrations. Its use avoids the difficult and tedious procedure of manual reward specification while retaining the generalization power of reinforcement learning. In IRL, the reward is usually represented as a linear combination of features. In continuous state spaces, the state variables alone are not sufficiently rich to be used as features, but which features are good is not known in general. To address this issue, we propose a method that employs polynomial basis functions to ","authors_text":"Daulet Baimukashev, Gokhan Alcan, Ville Kyrki","cross_cats":["cs.RO"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-03-22T10:05:21Z","title":"Automated Feature Selection for Inverse Reinforcement Learning"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2403.15079","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:cef1f5d0541d09ad2d2730b5515a71fc418ce31974fa4915ecb1731740a92538","target":"record","created_at":"2026-07-05T07:59:30Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"f2b043a5fb3f666c402f43a0f212e0372e33c9a352e4fde5f41acca828bbf800","cross_cats_sorted":["cs.RO"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2024-03-22T10:05:21Z","title_canon_sha256":"974d25263e725f811c4b80d5af53328178166b715b60470669482dbca58ea804"},"schema_version":"1.0","source":{"id":"2403.15079","kind":"arxiv","version":1}},"canonical_sha256":"29f8d5cda0f24a94c2b9ba1be95a2400bf89a31dd9a4ebbcf1cabc0333619f27","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"29f8d5cda0f24a94c2b9ba1be95a2400bf89a31dd9a4ebbcf1cabc0333619f27","first_computed_at":"2026-07-05T07:59:30.024054Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T07:59:30.024054Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"EcOqMz2RpWMAhfXfbOSbvOYrUMgINfCxPygNeWASrdQoTNisyD+LybczXS50F8AWAUpCU5+As2DUoR3og+oBDg==","signature_status":"signed_v1","signed_at":"2026-07-05T07:59:30.024550Z","signed_message":"canonical_sha256_bytes"},"source_id":"2403.15079","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:cef1f5d0541d09ad2d2730b5515a71fc418ce31974fa4915ecb1731740a92538","sha256:c9f2ee1bebfbb1c55fdc10e3c5692d0c2bd620e0b0053b371fbecd07698a7f62"],"state_sha256":"8bcd9c0bc88afb847f063fa056a9af4723fb04d3eec04ce932ceb3f2528a7e3b"}