{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2022:VL55ITEAHUVGZLOLEFQDYJIFRN","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"9960043434ea5643829353f93d639ca9e9044c7846bc798771a2e1ccdd232460","cross_cats_sorted":["cs.AI","stat.ML"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2022-05-22T04:23:54Z","title_canon_sha256":"392d07462a204a8f9901f4f160f932907f80ac9183b936f8e19260d122d5da10"},"schema_version":"1.0","source":{"id":"2205.10736","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2205.10736","created_at":"2026-07-05T04:25:23Z"},{"alias_kind":"arxiv_version","alias_value":"2205.10736v1","created_at":"2026-07-05T04:25:23Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2205.10736","created_at":"2026-07-05T04:25:23Z"},{"alias_kind":"pith_short_12","alias_value":"VL55ITEAHUVG","created_at":"2026-07-05T04:25:23Z"},{"alias_kind":"pith_short_16","alias_value":"VL55ITEAHUVGZLOL","created_at":"2026-07-05T04:25:23Z"},{"alias_kind":"pith_short_8","alias_value":"VL55ITEA","created_at":"2026-07-05T04:25:23Z"}],"graph_snapshots":[{"event_id":"sha256:ee7abbd1732bf1aacf7c39f0aa3489e0425cf17a5b5d7bc09d5dd000dfd182d9","target":"graph","created_at":"2026-07-05T04:25:23Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2205.10736/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Model-based Reinforcement Learning (MBRL) holds promise for data-efficiency by planning with model-generated experience in addition to learning with experience from the environment. However, in complex or changing environments, models in MBRL will inevitably be imperfect, and their detrimental effects on learning can be difficult to mitigate. In this work, we question whether the objective of these models should be the accurate simulation of environment dynamics at all. We focus our investigations on Dyna-style planning in a prediction setting. First, we highlight and support three motivating ","authors_text":"Anna Koop, Arash Pourzarabi, Esra'a Saleh, John D. Martin, Michael Bowling","cross_cats":["cs.AI","stat.ML"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2022-05-22T04:23:54Z","title":"Should Models Be Accurate?"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2205.10736","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:0555b5fdd5cb574b81ed1e1aea6397db2a09753826ef766bd9ec7cc4acc4f8c1","target":"record","created_at":"2026-07-05T04:25:23Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"9960043434ea5643829353f93d639ca9e9044c7846bc798771a2e1ccdd232460","cross_cats_sorted":["cs.AI","stat.ML"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2022-05-22T04:23:54Z","title_canon_sha256":"392d07462a204a8f9901f4f160f932907f80ac9183b936f8e19260d122d5da10"},"schema_version":"1.0","source":{"id":"2205.10736","kind":"arxiv","version":1}},"canonical_sha256":"aafbd44c803d2a6cadcb21603c25058b5240bead9d36f36bc1de408ceebec7d2","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"aafbd44c803d2a6cadcb21603c25058b5240bead9d36f36bc1de408ceebec7d2","first_computed_at":"2026-07-05T04:25:23.008709Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T04:25:23.008709Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"o5zM15HIWuoMYXnsL6pcfrRGFfcGjPwjKovIkFjGRVrTfocW4xqqHuUP4gSNTI2Nmp9JWieF3W6Sm3TCGgz0AA==","signature_status":"signed_v1","signed_at":"2026-07-05T04:25:23.009222Z","signed_message":"canonical_sha256_bytes"},"source_id":"2205.10736","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:0555b5fdd5cb574b81ed1e1aea6397db2a09753826ef766bd9ec7cc4acc4f8c1","sha256:ee7abbd1732bf1aacf7c39f0aa3489e0425cf17a5b5d7bc09d5dd000dfd182d9"],"state_sha256":"554cc0edf60e0e41521b20207faf5b414220ae96ca4f556c221535f3681b31f3"}