{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2017:4H5XE4S3KRTALLQUIGAELWXYRV","short_pith_number":"pith:4H5XE4S3","canonical_record":{"source":{"id":"1702.08360","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2017-02-27T16:32:27Z","cross_cats_sorted":[],"title_canon_sha256":"9c577101d480e721b2a6eacda0e5363ede3bae42eef1ce22b128cf570ba45336","abstract_canon_sha256":"14ba9381ba83295bf71543b89014bc2f10aa1e2f845da7a28712d55bb5ea1150"},"schema_version":"1.0"},"canonical_sha256":"e1fb72725b546605ae14418045daf88d476a2a393e9bb770866faf404ef7799b","source":{"kind":"arxiv","id":"1702.08360","version":1},"source_aliases":[{"alias_kind":"arxiv","alias_value":"1702.08360","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"arxiv_version","alias_value":"1702.08360v1","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.1702.08360","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"pith_short_12","alias_value":"4H5XE4S3KRTA","created_at":"2026-05-18T12:30:58Z"},{"alias_kind":"pith_short_16","alias_value":"4H5XE4S3KRTALLQU","created_at":"2026-05-18T12:30:58Z"},{"alias_kind":"pith_short_8","alias_value":"4H5XE4S3","created_at":"2026-05-18T12:30:58Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2017:4H5XE4S3KRTALLQUIGAELWXYRV","target":"record","payload":{"canonical_record":{"source":{"id":"1702.08360","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2017-02-27T16:32:27Z","cross_cats_sorted":[],"title_canon_sha256":"9c577101d480e721b2a6eacda0e5363ede3bae42eef1ce22b128cf570ba45336","abstract_canon_sha256":"14ba9381ba83295bf71543b89014bc2f10aa1e2f845da7a28712d55bb5ea1150"},"schema_version":"1.0"},"canonical_sha256":"e1fb72725b546605ae14418045daf88d476a2a393e9bb770866faf404ef7799b","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-05-18T00:49:55.122585Z","signature_b64":"h5LmRQaHdqIV+6ktCE5MY6dDJZ3xL/W+wC4Z0GJC0hY+ZRALqy2s6bWhAh2/tKEnesds9jjcKdGx36t6XEbkAA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"e1fb72725b546605ae14418045daf88d476a2a393e9bb770866faf404ef7799b","last_reissued_at":"2026-05-18T00:49:55.121853Z","signature_status":"signed_v1","first_computed_at":"2026-05-18T00:49:55.121853Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"1702.08360","source_version":1,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-05-18T00:49:55Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"4kwZ5PlyOLcjfRLCGDHGei1PIZbwZniOS6uQmNd2Be8DphGvOEpjBuPWLieD4rWD8WXm9obMkGu3AH3WRqFgDg==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-03T19:43:51.875156Z"},"content_sha256":"e25c1dde482b139d37fc259a309ce9df1bf0f3bc0e991c73a358fdd8bff610f4","schema_version":"1.0","event_id":"sha256:e25c1dde482b139d37fc259a309ce9df1bf0f3bc0e991c73a358fdd8bff610f4"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2017:4H5XE4S3KRTALLQUIGAELWXYRV","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"Neural Map: Structured Memory for Deep Reinforcement Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Emilio Parisotto, Ruslan Salakhutdinov","submitted_at":"2017-02-27T16:32:27Z","abstract_excerpt":"A critical component to enabling intelligent reasoning in partially observable environments is memory. Despite this importance, Deep Reinforcement Learning (DRL) agents have so far used relatively simple memory architectures, with the main methods to overcome partial observability being either a temporal convolution over the past k frames or an LSTM layer. More recent work (Oh et al., 2016) has went beyond these architectures by using memory networks which can allow more sophisticated addressing schemes over the past k frames. But even these architectures are unsatisfactory due to the reason t"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"1702.08360","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":null},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-05-18T00:49:55Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"1soj0NEdqEKBpKiax6oTKQW9sNso3KUj4NZN2L3eBwl+0dTcYiBqeFKwjwi54zjtQD4jdZKSgwZbmHkS6VvpDA==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-03T19:43:51.875607Z"},"content_sha256":"35a3e3a952c7d49952726afc749cf1f382d9b894c454f5aedbb5f730248a1be2","schema_version":"1.0","event_id":"sha256:35a3e3a952c7d49952726afc749cf1f382d9b894c454f5aedbb5f730248a1be2"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/4H5XE4S3KRTALLQUIGAELWXYRV/bundle.json","state_url":"https://pith.science/pith/4H5XE4S3KRTALLQUIGAELWXYRV/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/4H5XE4S3KRTALLQUIGAELWXYRV/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-03T19:43:51Z","links":{"resolver":"https://pith.science/pith/4H5XE4S3KRTALLQUIGAELWXYRV","bundle":"https://pith.science/pith/4H5XE4S3KRTALLQUIGAELWXYRV/bundle.json","state":"https://pith.science/pith/4H5XE4S3KRTALLQUIGAELWXYRV/state.json","well_known_bundle":"https://pith.science/.well-known/pith/4H5XE4S3KRTALLQUIGAELWXYRV/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2017:4H5XE4S3KRTALLQUIGAELWXYRV","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"14ba9381ba83295bf71543b89014bc2f10aa1e2f845da7a28712d55bb5ea1150","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2017-02-27T16:32:27Z","title_canon_sha256":"9c577101d480e721b2a6eacda0e5363ede3bae42eef1ce22b128cf570ba45336"},"schema_version":"1.0","source":{"id":"1702.08360","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"1702.08360","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"arxiv_version","alias_value":"1702.08360v1","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.1702.08360","created_at":"2026-05-18T00:49:55Z"},{"alias_kind":"pith_short_12","alias_value":"4H5XE4S3KRTA","created_at":"2026-05-18T12:30:58Z"},{"alias_kind":"pith_short_16","alias_value":"4H5XE4S3KRTALLQU","created_at":"2026-05-18T12:30:58Z"},{"alias_kind":"pith_short_8","alias_value":"4H5XE4S3","created_at":"2026-05-18T12:30:58Z"}],"graph_snapshots":[{"event_id":"sha256:35a3e3a952c7d49952726afc749cf1f382d9b894c454f5aedbb5f730248a1be2","target":"graph","created_at":"2026-05-18T00:49:55Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"paper":{"abstract_excerpt":"A critical component to enabling intelligent reasoning in partially observable environments is memory. Despite this importance, Deep Reinforcement Learning (DRL) agents have so far used relatively simple memory architectures, with the main methods to overcome partial observability being either a temporal convolution over the past k frames or an LSTM layer. More recent work (Oh et al., 2016) has went beyond these architectures by using memory networks which can allow more sophisticated addressing schemes over the past k frames. But even these architectures are unsatisfactory due to the reason t","authors_text":"Emilio Parisotto, Ruslan Salakhutdinov","cross_cats":[],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2017-02-27T16:32:27Z","title":"Neural Map: Structured Memory for Deep Reinforcement Learning"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"1702.08360","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:e25c1dde482b139d37fc259a309ce9df1bf0f3bc0e991c73a358fdd8bff610f4","target":"record","created_at":"2026-05-18T00:49:55Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"14ba9381ba83295bf71543b89014bc2f10aa1e2f845da7a28712d55bb5ea1150","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2017-02-27T16:32:27Z","title_canon_sha256":"9c577101d480e721b2a6eacda0e5363ede3bae42eef1ce22b128cf570ba45336"},"schema_version":"1.0","source":{"id":"1702.08360","kind":"arxiv","version":1}},"canonical_sha256":"e1fb72725b546605ae14418045daf88d476a2a393e9bb770866faf404ef7799b","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"e1fb72725b546605ae14418045daf88d476a2a393e9bb770866faf404ef7799b","first_computed_at":"2026-05-18T00:49:55.121853Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-05-18T00:49:55.121853Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"h5LmRQaHdqIV+6ktCE5MY6dDJZ3xL/W+wC4Z0GJC0hY+ZRALqy2s6bWhAh2/tKEnesds9jjcKdGx36t6XEbkAA==","signature_status":"signed_v1","signed_at":"2026-05-18T00:49:55.122585Z","signed_message":"canonical_sha256_bytes"},"source_id":"1702.08360","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:e25c1dde482b139d37fc259a309ce9df1bf0f3bc0e991c73a358fdd8bff610f4","sha256:35a3e3a952c7d49952726afc749cf1f382d9b894c454f5aedbb5f730248a1be2"],"state_sha256":"06c811046db72316391b299452f9ee1ba4bb22dbbdaf9c163ca71e1a93ce5dfd"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"SUqYHjSdpgrQZWgGQlCVScaNfQrKC/6D2NvNv0MKxOcMQ3mSv5g2gCC6uU7Exi27d9lxYyIx6FPOxTOYFAN6Ag==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-03T19:43:51.880268Z","bundle_sha256":"64f579419ae1a476f3d763af8df7c83c04c9031434261b49ef0a48db13c76d07"}}