{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2020:JKAQN5Y2NDEDXSTMSJWVY3N5XU","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"3f5d06611f45841bc395214f0b3c8bbc31494411542ae96744578f7835b45d73","cross_cats_sorted":["cs.AI","cs.RO"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2020-10-22T17:59:51Z","title_canon_sha256":"530ba4c4dc3543aa501ea8ee5405b284dbb8bbcbe41dba5dd2ce251df0ee235e"},"schema_version":"1.0","source":{"id":"2010.11944","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2010.11944","created_at":"2026-07-05T01:45:22Z"},{"alias_kind":"arxiv_version","alias_value":"2010.11944v1","created_at":"2026-07-05T01:45:22Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2010.11944","created_at":"2026-07-05T01:45:22Z"},{"alias_kind":"pith_short_12","alias_value":"JKAQN5Y2NDED","created_at":"2026-07-05T01:45:22Z"},{"alias_kind":"pith_short_16","alias_value":"JKAQN5Y2NDEDXSTM","created_at":"2026-07-05T01:45:22Z"},{"alias_kind":"pith_short_8","alias_value":"JKAQN5Y2","created_at":"2026-07-05T01:45:22Z"}],"graph_snapshots":[{"event_id":"sha256:084cddb86850ac68ec45257b1164b6f7e0599a1b5c6b8a5c127b86258b419bdb","target":"graph","created_at":"2026-07-05T01:45:22Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2010.11944/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Intelligent agents rely heavily on prior experience when learning a new task, yet most modern reinforcement learning (RL) approaches learn every task from scratch. One approach for leveraging prior knowledge is to transfer skills learned on prior tasks to the new task. However, as the amount of prior experience increases, the number of transferable skills grows too, making it challenging to explore the full set of available skills during downstream learning. Yet, intuitively, not all skills should be explored with equal probability; for example information about the current state can hint whic","authors_text":"Joseph J. Lim, Karl Pertsch, Youngwoon Lee","cross_cats":["cs.AI","cs.RO"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2020-10-22T17:59:51Z","title":"Accelerating Reinforcement Learning with Learned Skill Priors"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2010.11944","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:b83ad9f284be8c3de535c3ad45a989b3b2c9383230d5f02dcea683c3f50a1b2d","target":"record","created_at":"2026-07-05T01:45:22Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"3f5d06611f45841bc395214f0b3c8bbc31494411542ae96744578f7835b45d73","cross_cats_sorted":["cs.AI","cs.RO"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2020-10-22T17:59:51Z","title_canon_sha256":"530ba4c4dc3543aa501ea8ee5405b284dbb8bbcbe41dba5dd2ce251df0ee235e"},"schema_version":"1.0","source":{"id":"2010.11944","kind":"arxiv","version":1}},"canonical_sha256":"4a8106f71a68c83bca6c926d5c6dbdbd09dde4b55cd87d03d98e8b97319e4d5c","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"4a8106f71a68c83bca6c926d5c6dbdbd09dde4b55cd87d03d98e8b97319e4d5c","first_computed_at":"2026-07-05T01:45:22.352745Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T01:45:22.352745Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"3z4/dTcjMjtxavijj3R8l0gg9P/RfQdq1OKLXGwHnK64tQKTUdSgPtQSbpkNLR4PUuieMALSbFXh8tZOMwxTAg==","signature_status":"signed_v1","signed_at":"2026-07-05T01:45:22.353094Z","signed_message":"canonical_sha256_bytes"},"source_id":"2010.11944","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:b83ad9f284be8c3de535c3ad45a989b3b2c9383230d5f02dcea683c3f50a1b2d","sha256:084cddb86850ac68ec45257b1164b6f7e0599a1b5c6b8a5c127b86258b419bdb"],"state_sha256":"57c48335862227ca361723835e2e9ac4e0602202d4c7d9cc529905636dd340cb"}