{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:E24MXDD2F5DLGW3VZ5WXANVM2X","short_pith_number":"pith:E24MXDD2","schema_version":"1.0","canonical_sha256":"26b8cb8c7a2f46b35b75cf6d7036acd5d25128ed00f5f1c493533baeeb1de070","source":{"kind":"arxiv","id":"2405.20690","version":2},"attestation_state":"computed","paper":{"title":"DiffPuter: Empowering Diffusion Models for Missing Data Imputation","license":"http://creativecommons.org/licenses/by-sa/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Hengrui Zhang, Liancheng Fang, Philip S. Yu, Qitian Wu","submitted_at":"2024-05-31T08:35:56Z","abstract_excerpt":"Generative models play an important role in missing data imputation in that they aim to learn the joint distribution of full data. However, applying advanced deep generative models (such as Diffusion models) to missing data imputation is challenging due to 1) the inherent incompleteness of the training data and 2) the difficulty in performing conditional inference from unconditional generative models. To deal with these challenges, this paper introduces DiffPuter, a tailored diffusion model combined with the Expectation-Maximization (EM) algorithm for missing data imputation. DiffPuter iterati"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2405.20690","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by-sa/4.0/","primary_cat":"cs.LG","submitted_at":"2024-05-31T08:35:56Z","cross_cats_sorted":[],"title_canon_sha256":"1f18331fbcc7d118538b0f38f2468689ffd9494d25bdd4f897e5a4620dd45b74","abstract_canon_sha256":"16b10f6c79e3cb0370be5d66b868d4a7a8ea84a66712eb67027b4b95eca53397"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:08:38.161366Z","signature_b64":"oP5OjAVlEUOjJGr5u35NY5UC75OP4Zh836uzXjBMfsbP5kfMT5putP5OPqq5h7o0h/bxZY2X1ef5qRZVUxgHCQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"26b8cb8c7a2f46b35b75cf6d7036acd5d25128ed00f5f1c493533baeeb1de070","last_reissued_at":"2026-07-05T11:08:38.160896Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:08:38.160896Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"DiffPuter: Empowering Diffusion Models for Missing Data Imputation","license":"http://creativecommons.org/licenses/by-sa/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.LG","authors_text":"Hengrui Zhang, Liancheng Fang, Philip S. Yu, Qitian Wu","submitted_at":"2024-05-31T08:35:56Z","abstract_excerpt":"Generative models play an important role in missing data imputation in that they aim to learn the joint distribution of full data. However, applying advanced deep generative models (such as Diffusion models) to missing data imputation is challenging due to 1) the inherent incompleteness of the training data and 2) the difficulty in performing conditional inference from unconditional generative models. To deal with these challenges, this paper introduces DiffPuter, a tailored diffusion model combined with the Expectation-Maximization (EM) algorithm for missing data imputation. DiffPuter iterati"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2405.20690","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2405.20690/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2405.20690","created_at":"2026-07-05T11:08:38.160954+00:00"},{"alias_kind":"arxiv_version","alias_value":"2405.20690v2","created_at":"2026-07-05T11:08:38.160954+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2405.20690","created_at":"2026-07-05T11:08:38.160954+00:00"},{"alias_kind":"pith_short_12","alias_value":"E24MXDD2F5DL","created_at":"2026-07-05T11:08:38.160954+00:00"},{"alias_kind":"pith_short_16","alias_value":"E24MXDD2F5DLGW3V","created_at":"2026-07-05T11:08:38.160954+00:00"},{"alias_kind":"pith_short_8","alias_value":"E24MXDD2","created_at":"2026-07-05T11:08:38.160954+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":3,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.28427","citing_title":"Latent Diffusion for Missing Data","ref_index":10,"is_internal_anchor":false},{"citing_arxiv_id":"2502.17119","citing_title":"Diffusion and Flow Matching Models for Tabular Data: A Survey","ref_index":118,"is_internal_anchor":false},{"citing_arxiv_id":"2604.24959","citing_title":"CoreFlow: Low-Rank Matrix Generative Models","ref_index":46,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X","json":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X.json","graph_json":"https://pith.science/api/pith-number/E24MXDD2F5DLGW3VZ5WXANVM2X/graph.json","events_json":"https://pith.science/api/pith-number/E24MXDD2F5DLGW3VZ5WXANVM2X/events.json","paper":"https://pith.science/paper/E24MXDD2"},"agent_actions":{"view_html":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X","download_json":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X.json","view_paper":"https://pith.science/paper/E24MXDD2","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2405.20690&json=true","fetch_graph":"https://pith.science/api/pith-number/E24MXDD2F5DLGW3VZ5WXANVM2X/graph.json","fetch_events":"https://pith.science/api/pith-number/E24MXDD2F5DLGW3VZ5WXANVM2X/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X/action/timestamp_anchor","attest_storage":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X/action/storage_attestation","attest_author":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X/action/author_attestation","sign_citation":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X/action/citation_signature","submit_replication":"https://pith.science/pith/E24MXDD2F5DLGW3VZ5WXANVM2X/action/replication_record"}},"created_at":"2026-07-05T11:08:38.160954+00:00","updated_at":"2026-07-05T11:08:38.160954+00:00"}