{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:PFUWKUECSVHUEWPYIJMC4ONO6Y","short_pith_number":"pith:PFUWKUEC","schema_version":"1.0","canonical_sha256":"7969655082954f4259f842582e39aef61a16ebe40fa1c1021e89c71c6d4a0759","source":{"kind":"arxiv","id":"2310.02596","version":2},"attestation_state":"computed","paper":{"title":"SweetDreamer: Aligning Geometric Priors in 2D Diffusion for Consistent Text-to-3D","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Ping Tan, Rui Chen, Weiyu Li, Xuelin Chen","submitted_at":"2023-10-04T05:59:50Z","abstract_excerpt":"It is inherently ambiguous to lift 2D results from pre-trained diffusion models to a 3D world for text-to-3D generation. 2D diffusion models solely learn view-agnostic priors and thus lack 3D knowledge during the lifting, leading to the multi-view inconsistency problem. We find that this problem primarily stems from geometric inconsistency, and avoiding misplaced geometric structures substantially mitigates the problem in the final outputs. Therefore, we improve the consistency by aligning the 2D geometric priors in diffusion models with well-defined 3D shapes during the lifting, addressing th"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2310.02596","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CV","submitted_at":"2023-10-04T05:59:50Z","cross_cats_sorted":[],"title_canon_sha256":"4aaf8b46e4001cb7408cb379099be1aa53126acc201ca0f2360d489b0173e91c","abstract_canon_sha256":"116e40d3c1b7f8c949fe070663fc419c54e63b169224359c4dedd7a4e260be91"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T07:02:54.135288Z","signature_b64":"+4v8ExlwMB2bGcaRjw+I8Xmx0qm3yAMyQVf7U1gyI62KkE0mORmtRUu4SGYMzbh4sRBt/56dEjp+IcCnjIFaDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"7969655082954f4259f842582e39aef61a16ebe40fa1c1021e89c71c6d4a0759","last_reissued_at":"2026-07-05T07:02:54.134777Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T07:02:54.134777Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"SweetDreamer: Aligning Geometric Priors in 2D Diffusion for Consistent Text-to-3D","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Ping Tan, Rui Chen, Weiyu Li, Xuelin Chen","submitted_at":"2023-10-04T05:59:50Z","abstract_excerpt":"It is inherently ambiguous to lift 2D results from pre-trained diffusion models to a 3D world for text-to-3D generation. 2D diffusion models solely learn view-agnostic priors and thus lack 3D knowledge during the lifting, leading to the multi-view inconsistency problem. We find that this problem primarily stems from geometric inconsistency, and avoiding misplaced geometric structures substantially mitigates the problem in the final outputs. Therefore, we improve the consistency by aligning the 2D geometric priors in diffusion models with well-defined 3D shapes during the lifting, addressing th"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2310.02596","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2310.02596/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2310.02596","created_at":"2026-07-05T07:02:54.134851+00:00"},{"alias_kind":"arxiv_version","alias_value":"2310.02596v2","created_at":"2026-07-05T07:02:54.134851+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2310.02596","created_at":"2026-07-05T07:02:54.134851+00:00"},{"alias_kind":"pith_short_12","alias_value":"PFUWKUECSVHU","created_at":"2026-07-05T07:02:54.134851+00:00"},{"alias_kind":"pith_short_16","alias_value":"PFUWKUECSVHUEWPY","created_at":"2026-07-05T07:02:54.134851+00:00"},{"alias_kind":"pith_short_8","alias_value":"PFUWKUEC","created_at":"2026-07-05T07:02:54.134851+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.06565","citing_title":"ELSA3D: Elastic Semantic Anchoring for Unified 3D Understanding and Generation","ref_index":83,"is_internal_anchor":true},{"citing_arxiv_id":"2607.01803","citing_title":"PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation","ref_index":19,"is_internal_anchor":false},{"citing_arxiv_id":"2509.07435","citing_title":"DreamLifting: A Plug-in Module Lifting MV Diffusion Models for 3D Asset Generation","ref_index":52,"is_internal_anchor":false},{"citing_arxiv_id":"2309.16653","citing_title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","ref_index":112,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y","json":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y.json","graph_json":"https://pith.science/api/pith-number/PFUWKUECSVHUEWPYIJMC4ONO6Y/graph.json","events_json":"https://pith.science/api/pith-number/PFUWKUECSVHUEWPYIJMC4ONO6Y/events.json","paper":"https://pith.science/paper/PFUWKUEC"},"agent_actions":{"view_html":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y","download_json":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y.json","view_paper":"https://pith.science/paper/PFUWKUEC","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2310.02596&json=true","fetch_graph":"https://pith.science/api/pith-number/PFUWKUECSVHUEWPYIJMC4ONO6Y/graph.json","fetch_events":"https://pith.science/api/pith-number/PFUWKUECSVHUEWPYIJMC4ONO6Y/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y/action/timestamp_anchor","attest_storage":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y/action/storage_attestation","attest_author":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y/action/author_attestation","sign_citation":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y/action/citation_signature","submit_replication":"https://pith.science/pith/PFUWKUECSVHUEWPYIJMC4ONO6Y/action/replication_record"}},"created_at":"2026-07-05T07:02:54.134851+00:00","updated_at":"2026-07-05T07:02:54.134851+00:00"}