{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2022:YHYSRGA2SMC3TSEHYRNGD5PKP5","short_pith_number":"pith:YHYSRGA2","canonical_record":{"source":{"id":"2209.04100","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2022-09-09T03:02:49Z","cross_cats_sorted":[],"title_canon_sha256":"132512b409440dda165b22eb647775424e05d618eeecb1666a2af87dcadc7ce8","abstract_canon_sha256":"ade6e8af73bcd15aeb6e66dd4a8988ff752b2f7df3679e2fb066aff1205f056c"},"schema_version":"1.0"},"canonical_sha256":"c1f128981a9305b9c887c45a61f5ea7f45ead453006054557db99d837b22a21d","source":{"kind":"arxiv","id":"2209.04100","version":3},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2209.04100","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"arxiv_version","alias_value":"2209.04100v3","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2209.04100","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_12","alias_value":"YHYSRGA2SMC3","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_16","alias_value":"YHYSRGA2SMC3TSEH","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_8","alias_value":"YHYSRGA2","created_at":"2026-07-05T10:54:29Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2022:YHYSRGA2SMC3TSEHYRNGD5PKP5","target":"record","payload":{"canonical_record":{"source":{"id":"2209.04100","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2022-09-09T03:02:49Z","cross_cats_sorted":[],"title_canon_sha256":"132512b409440dda165b22eb647775424e05d618eeecb1666a2af87dcadc7ce8","abstract_canon_sha256":"ade6e8af73bcd15aeb6e66dd4a8988ff752b2f7df3679e2fb066aff1205f056c"},"schema_version":"1.0"},"canonical_sha256":"c1f128981a9305b9c887c45a61f5ea7f45ead453006054557db99d837b22a21d","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:54:29.188078Z","signature_b64":"EFyCCprzOugr6TvVRQ0KQr8CYUgAN4/lnMEJrmwihkKfZ1E1di+8OcEAb5JHVDm/q0abZ8IKgqhDtqhfP9D5DQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"c1f128981a9305b9c887c45a61f5ea7f45ead453006054557db99d837b22a21d","last_reissued_at":"2026-07-05T10:54:29.187602Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:54:29.187602Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2209.04100","source_version":3,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T10:54:29Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"G+bfCvGuj1MOq8lswIQbwbyMoBApSwM/tFWt6x0wiZXGJZNRIm53bIDDx6dZnpq+l3pBPpVUa9qdS6Bo70jZAg==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-14T08:25:37.065682Z"},"content_sha256":"c4caf4ce7e8e498337086fcae801b11f240012eab33504e16e460375142bb7d4","schema_version":"1.0","event_id":"sha256:c4caf4ce7e8e498337086fcae801b11f240012eab33504e16e460375142bb7d4"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2022:YHYSRGA2SMC3TSEHYRNGD5PKP5","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"Task-Agnostic Learning to Accomplish New Tasks","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.AI","authors_text":"Debin Zhao, Wenrui Wang, Xianqi Zhang, Xiaopeng Fan, Xingtao Wang, Xu Liu","submitted_at":"2022-09-09T03:02:49Z","abstract_excerpt":"Reinforcement Learning (RL) and Imitation Learning (IL) have made great progress in robotic decision-making in recent years. However, these methods show obvious deterioration for new tasks that need to be completed through new combinations of actions. RL methods suffer from reward functions and distribution shifts, while IL methods are limited by expert demonstrations which do not cover new tasks. In contrast, humans can easily complete these tasks with the fragmented knowledge learned from task-agnostic experience. Inspired by this observation, this paper proposes a task-agnostic learning met"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2209.04100","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2209.04100/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-05T10:54:29Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"fZD+q6foPJFStY0M/MKSKG2ec5ijDYjSN1OQaJ+J9LJQoB65GXoxOEcKKA12sCdTHlYVYlH4GAiFGFJdLZ1XAA==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-14T08:25:37.066234Z"},"content_sha256":"77d25f81dd98194b2de8ea2683c3db058a4313e300d6acb91e78e28e210dff26","schema_version":"1.0","event_id":"sha256:77d25f81dd98194b2de8ea2683c3db058a4313e300d6acb91e78e28e210dff26"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/bundle.json","state_url":"https://pith.science/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-14T08:25:37Z","links":{"resolver":"https://pith.science/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5","bundle":"https://pith.science/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/bundle.json","state":"https://pith.science/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/state.json","well_known_bundle":"https://pith.science/.well-known/pith/YHYSRGA2SMC3TSEHYRNGD5PKP5/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2022:YHYSRGA2SMC3TSEHYRNGD5PKP5","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"ade6e8af73bcd15aeb6e66dd4a8988ff752b2f7df3679e2fb066aff1205f056c","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2022-09-09T03:02:49Z","title_canon_sha256":"132512b409440dda165b22eb647775424e05d618eeecb1666a2af87dcadc7ce8"},"schema_version":"1.0","source":{"id":"2209.04100","kind":"arxiv","version":3}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2209.04100","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"arxiv_version","alias_value":"2209.04100v3","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2209.04100","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_12","alias_value":"YHYSRGA2SMC3","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_16","alias_value":"YHYSRGA2SMC3TSEH","created_at":"2026-07-05T10:54:29Z"},{"alias_kind":"pith_short_8","alias_value":"YHYSRGA2","created_at":"2026-07-05T10:54:29Z"}],"graph_snapshots":[{"event_id":"sha256:77d25f81dd98194b2de8ea2683c3db058a4313e300d6acb91e78e28e210dff26","target":"graph","created_at":"2026-07-05T10:54:29Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2209.04100/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Reinforcement Learning (RL) and Imitation Learning (IL) have made great progress in robotic decision-making in recent years. However, these methods show obvious deterioration for new tasks that need to be completed through new combinations of actions. RL methods suffer from reward functions and distribution shifts, while IL methods are limited by expert demonstrations which do not cover new tasks. In contrast, humans can easily complete these tasks with the fragmented knowledge learned from task-agnostic experience. Inspired by this observation, this paper proposes a task-agnostic learning met","authors_text":"Debin Zhao, Wenrui Wang, Xianqi Zhang, Xiaopeng Fan, Xingtao Wang, Xu Liu","cross_cats":[],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2022-09-09T03:02:49Z","title":"Task-Agnostic Learning to Accomplish New Tasks"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2209.04100","kind":"arxiv","version":3},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:c4caf4ce7e8e498337086fcae801b11f240012eab33504e16e460375142bb7d4","target":"record","created_at":"2026-07-05T10:54:29Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"ade6e8af73bcd15aeb6e66dd4a8988ff752b2f7df3679e2fb066aff1205f056c","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2022-09-09T03:02:49Z","title_canon_sha256":"132512b409440dda165b22eb647775424e05d618eeecb1666a2af87dcadc7ce8"},"schema_version":"1.0","source":{"id":"2209.04100","kind":"arxiv","version":3}},"canonical_sha256":"c1f128981a9305b9c887c45a61f5ea7f45ead453006054557db99d837b22a21d","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"c1f128981a9305b9c887c45a61f5ea7f45ead453006054557db99d837b22a21d","first_computed_at":"2026-07-05T10:54:29.187602Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T10:54:29.187602Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"EFyCCprzOugr6TvVRQ0KQr8CYUgAN4/lnMEJrmwihkKfZ1E1di+8OcEAb5JHVDm/q0abZ8IKgqhDtqhfP9D5DQ==","signature_status":"signed_v1","signed_at":"2026-07-05T10:54:29.188078Z","signed_message":"canonical_sha256_bytes"},"source_id":"2209.04100","source_kind":"arxiv","source_version":3}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:c4caf4ce7e8e498337086fcae801b11f240012eab33504e16e460375142bb7d4","sha256:77d25f81dd98194b2de8ea2683c3db058a4313e300d6acb91e78e28e210dff26"],"state_sha256":"8be253dc2e88bfcda6ce2b56aa59bc32ef6e302627866c0d649b09a0f9032da6"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"oXFUm+XjkEuGmH2IQIt7m/Vd35Iy1eY7BgIQ74VjjItgd90Izg9dL4grzfZz2zOFx4SFNVc9GoJK141IYt1QBg==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-14T08:25:37.072510Z","bundle_sha256":"3fa1ef8d22e9f285b51863751aaf946fd2a3a0b25d4585c5d7649d0b29999a69"}}