{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2019:PEYB76AQYOLMVMM77L2KKIIKOP","short_pith_number":"pith:PEYB76AQ","schema_version":"1.0","canonical_sha256":"79301ff810c396cab19ffaf4a5210a73e3609c518773cfbe9fe493ceff3f1ea3","source":{"kind":"arxiv","id":"1903.01973","version":2},"attestation_state":"computed","paper":{"title":"Learning Latent Plans from Play","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Corey Lynch, Jonathan Tompson, Mohi Khansari, Pierre Sermanet, Sergey Levine, Ted Xiao, Vikash Kumar","submitted_at":"2019-03-05T18:36:42Z","abstract_excerpt":"Acquiring a diverse repertoire of general-purpose skills remains an open challenge for robotics. In this work, we propose self-supervising control on top of human teleoperated play data as a way to scale up skill learning. Play has two properties that make it attractive compared to conventional task demonstrations. Play is cheap, as it can be collected in large quantities quickly without task segmenting, labeling, or resetting to an initial state. Play is naturally rich, covering ~4x more interaction space than task demonstrations for the same amount of collection time. To learn control from p"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"1903.01973","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.RO","submitted_at":"2019-03-05T18:36:42Z","cross_cats_sorted":[],"title_canon_sha256":"a6c7837ac63f4175bc5dfcce1120ee2f403a625be4031c27fbbdf66ebc449593","abstract_canon_sha256":"4eedab3d44ccfb9e081f090e55d6fcbdb1e2302ff1dad4dcd72374a9f4d99514"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T00:27:30.872967Z","signature_b64":"7XHpA3Y5Ti+K96jLvWpqD7RaSetBCBlJZUuH6PLbVg3x+X6Is4fU4425OJ5NiH8PHfNciserH9OXBGkEG8UIBA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"79301ff810c396cab19ffaf4a5210a73e3609c518773cfbe9fe493ceff3f1ea3","last_reissued_at":"2026-07-05T00:27:30.872491Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T00:27:30.872491Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Learning Latent Plans from Play","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Corey Lynch, Jonathan Tompson, Mohi Khansari, Pierre Sermanet, Sergey Levine, Ted Xiao, Vikash Kumar","submitted_at":"2019-03-05T18:36:42Z","abstract_excerpt":"Acquiring a diverse repertoire of general-purpose skills remains an open challenge for robotics. In this work, we propose self-supervising control on top of human teleoperated play data as a way to scale up skill learning. Play has two properties that make it attractive compared to conventional task demonstrations. Play is cheap, as it can be collected in large quantities quickly without task segmenting, labeling, or resetting to an initial state. Play is naturally rich, covering ~4x more interaction space than task demonstrations for the same amount of collection time. To learn control from p"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"1903.01973","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/1903.01973/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"1903.01973","created_at":"2026-07-05T00:27:30.872548+00:00"},{"alias_kind":"arxiv_version","alias_value":"1903.01973v2","created_at":"2026-07-05T00:27:30.872548+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.1903.01973","created_at":"2026-07-05T00:27:30.872548+00:00"},{"alias_kind":"pith_short_12","alias_value":"PEYB76AQYOLM","created_at":"2026-07-05T00:27:30.872548+00:00"},{"alias_kind":"pith_short_16","alias_value":"PEYB76AQYOLMVMM7","created_at":"2026-07-05T00:27:30.872548+00:00"},{"alias_kind":"pith_short_8","alias_value":"PEYB76AQ","created_at":"2026-07-05T00:27:30.872548+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":10,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.00229","citing_title":"Continuous Reasoning for Vision-Language-Action","ref_index":42,"is_internal_anchor":false},{"citing_arxiv_id":"1906.10124","citing_title":"On Multi-Agent Learning in Team Sports Games","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2510.01433","citing_title":"AFFORD2ACT: Affordance-Guided Automatic Keypoint Selection for Generalizable and Lightweight Robotic Manipulation","ref_index":34,"is_internal_anchor":false},{"citing_arxiv_id":"1910.11215","citing_title":"RoboNet: Large-Scale Multi-Robot Learning","ref_index":11,"is_internal_anchor":false},{"citing_arxiv_id":"2409.12917","citing_title":"Training Language Models to Self-Correct via Reinforcement Learning","ref_index":212,"is_internal_anchor":false},{"citing_arxiv_id":"1910.07113","citing_title":"Solving Rubik's Cube with a Robot Hand","ref_index":63,"is_internal_anchor":false},{"citing_arxiv_id":"2605.13918","citing_title":"CA2: Code-Aware Agent for Automated Game Testing","ref_index":27,"is_internal_anchor":false},{"citing_arxiv_id":"2605.09364","citing_title":"Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning","ref_index":24,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16903","citing_title":"Leveraging VR Robot Games to Facilitate Data Collection for Embodied Intelligence Tasks","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2604.22551","citing_title":"QDTraj: Exploration of Diverse Trajectory Primitives for Articulated Objects Robotic Manipulation","ref_index":7,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP","json":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP.json","graph_json":"https://pith.science/api/pith-number/PEYB76AQYOLMVMM77L2KKIIKOP/graph.json","events_json":"https://pith.science/api/pith-number/PEYB76AQYOLMVMM77L2KKIIKOP/events.json","paper":"https://pith.science/paper/PEYB76AQ"},"agent_actions":{"view_html":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP","download_json":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP.json","view_paper":"https://pith.science/paper/PEYB76AQ","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=1903.01973&json=true","fetch_graph":"https://pith.science/api/pith-number/PEYB76AQYOLMVMM77L2KKIIKOP/graph.json","fetch_events":"https://pith.science/api/pith-number/PEYB76AQYOLMVMM77L2KKIIKOP/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP/action/timestamp_anchor","attest_storage":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP/action/storage_attestation","attest_author":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP/action/author_attestation","sign_citation":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP/action/citation_signature","submit_replication":"https://pith.science/pith/PEYB76AQYOLMVMM77L2KKIIKOP/action/replication_record"}},"created_at":"2026-07-05T00:27:30.872548+00:00","updated_at":"2026-07-05T00:27:30.872548+00:00"}