{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2023:L43BG72CJIGOU3FXLJJ2KWZIVY","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"c7dd7a6a232bb9f83b33c87a75fa5d7ead8b20c2556016c32127ba16e0567712","cross_cats_sorted":["cs.DC"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2023-01-26T14:39:34Z","title_canon_sha256":"23a7cc587f92543bcaebf09fe342895af3d68963fc24d3e9766e37dd5ba5d460"},"schema_version":"1.0","source":{"id":"2301.11135","kind":"arxiv","version":1}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2301.11135","created_at":"2026-07-05T05:36:10Z"},{"alias_kind":"arxiv_version","alias_value":"2301.11135v1","created_at":"2026-07-05T05:36:10Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2301.11135","created_at":"2026-07-05T05:36:10Z"},{"alias_kind":"pith_short_12","alias_value":"L43BG72CJIGO","created_at":"2026-07-05T05:36:10Z"},{"alias_kind":"pith_short_16","alias_value":"L43BG72CJIGOU3FX","created_at":"2026-07-05T05:36:10Z"},{"alias_kind":"pith_short_8","alias_value":"L43BG72C","created_at":"2026-07-05T05:36:10Z"}],"graph_snapshots":[{"event_id":"sha256:2be36dc87cf64556533a79887201963969b31beba1d5c81ad71bf9789161c8c7","target":"graph","created_at":"2026-07-05T05:36:10Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2301.11135/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Federated Reinforcement Learning (FedRL) encourages distributed agents to learn collectively from each other's experience to improve their performance without exchanging their raw trajectories. The existing work on FedRL assumes that all participating agents are homogeneous, which requires all agents to share the same policy parameterization (e.g., network architectures and training configurations). However, in real-world applications, agents are often in disagreement about the architecture and the parameters, possibly also because of disparate computational budgets. Because homogeneity is not","authors_text":"Bryan Kian Hsiang Low, Cheston Tan, Flint Xiaofeng Fan, Roger Wattenhofer, Yining Ma, Zhongxiang Dai","cross_cats":["cs.DC"],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2023-01-26T14:39:34Z","title":"FedHQL: Federated Heterogeneous Q-Learning"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2301.11135","kind":"arxiv","version":1},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:1ec72805446f00012e0327c77ece49e30b09e4b07378ae08c634bd5c0b4168f0","target":"record","created_at":"2026-07-05T05:36:10Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"c7dd7a6a232bb9f83b33c87a75fa5d7ead8b20c2556016c32127ba16e0567712","cross_cats_sorted":["cs.DC"],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2023-01-26T14:39:34Z","title_canon_sha256":"23a7cc587f92543bcaebf09fe342895af3d68963fc24d3e9766e37dd5ba5d460"},"schema_version":"1.0","source":{"id":"2301.11135","kind":"arxiv","version":1}},"canonical_sha256":"5f36137f424a0cea6cb75a53a55b28ae01b255f13bd777a25712083279992480","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"5f36137f424a0cea6cb75a53a55b28ae01b255f13bd777a25712083279992480","first_computed_at":"2026-07-05T05:36:10.844211Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T05:36:10.844211Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"aObWIQ/pGG+g1hOg6i15w6x3tjFQv3lqePb/2M5TtDWELt+VJifNNiFiXsBYH9UYK4Hit26CLPE3EehYk36lDg==","signature_status":"signed_v1","signed_at":"2026-07-05T05:36:10.844697Z","signed_message":"canonical_sha256_bytes"},"source_id":"2301.11135","source_kind":"arxiv","source_version":1}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:1ec72805446f00012e0327c77ece49e30b09e4b07378ae08c634bd5c0b4168f0","sha256:2be36dc87cf64556533a79887201963969b31beba1d5c81ad71bf9789161c8c7"],"state_sha256":"1a8079a493435e6e47cdd1ded719e15557e9699db2051d8ff564b2941947ec29"}