{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:STWCDIS6JG6QTXYUQW34OSBU57","short_pith_number":"pith:STWCDIS6","schema_version":"1.0","canonical_sha256":"94ec21a25e49bd09df1485b7c74834efcdf9af56dcfa8d7c9881e33bd27904f3","source":{"kind":"arxiv","id":"2506.07977","version":3},"attestation_state":"computed","paper":{"title":"OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Gang Yu, Hai-Bao Chen, Jingjing Chang, Peng Xing, Rui Wang, Shuhan Wu, Wei Cheng, Xianfang Zeng, Yixiao Fang","submitted_at":"2025-06-09T17:50:21Z","abstract_excerpt":"Text-to-image (T2I) models have garnered significant attention for generating high-quality images aligned with text prompts. However, rapid T2I model advancements reveal limitations in early benchmarks, lacking comprehensive evaluations, for example, the evaluation on reasoning, text rendering and style. Notably, recent state-of-the-art models, with their rich knowledge modeling capabilities, show promising results on the image generation problems requiring strong reasoning ability, yet existing evaluation systems have not adequately addressed this frontier. To systematically address these gap"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2506.07977","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2025-06-09T17:50:21Z","cross_cats_sorted":[],"title_canon_sha256":"bdbacdbd47428dc5be0359b031ac91f90488e2f557e291887ba5ae0e0bea4a49","abstract_canon_sha256":"5233f1f0e0274437d246c67d9a592d9d043fdabff52bfb7c6803a04388ef3663"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:27:30.725371Z","signature_b64":"zuHV4kS+YurKi+KfiKHUmI3B3W5Ozs+XcEMnnn2UAvj4Aokk12QPUo7GM3RqX3pTTQs4Z/Fwxv7SlDQ3PKQ0DQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"94ec21a25e49bd09df1485b7c74834efcdf9af56dcfa8d7c9881e33bd27904f3","last_reissued_at":"2026-07-05T11:27:30.724872Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:27:30.724872Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"OneIG-Bench: Omni-dimensional Nuanced Evaluation for Image Generation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Gang Yu, Hai-Bao Chen, Jingjing Chang, Peng Xing, Rui Wang, Shuhan Wu, Wei Cheng, Xianfang Zeng, Yixiao Fang","submitted_at":"2025-06-09T17:50:21Z","abstract_excerpt":"Text-to-image (T2I) models have garnered significant attention for generating high-quality images aligned with text prompts. However, rapid T2I model advancements reveal limitations in early benchmarks, lacking comprehensive evaluations, for example, the evaluation on reasoning, text rendering and style. Notably, recent state-of-the-art models, with their rich knowledge modeling capabilities, show promising results on the image generation problems requiring strong reasoning ability, yet existing evaluation systems have not adequately addressed this frontier. To systematically address these gap"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2506.07977","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2506.07977/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2506.07977","created_at":"2026-07-05T11:27:30.724936+00:00"},{"alias_kind":"arxiv_version","alias_value":"2506.07977v3","created_at":"2026-07-05T11:27:30.724936+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2506.07977","created_at":"2026-07-05T11:27:30.724936+00:00"},{"alias_kind":"pith_short_12","alias_value":"STWCDIS6JG6Q","created_at":"2026-07-05T11:27:30.724936+00:00"},{"alias_kind":"pith_short_16","alias_value":"STWCDIS6JG6QTXYU","created_at":"2026-07-05T11:27:30.724936+00:00"},{"alias_kind":"pith_short_8","alias_value":"STWCDIS6","created_at":"2026-07-05T11:27:30.724936+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":14,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.27089","citing_title":"TMP: Tree-structured Mixed-policy Pruning for Large-scale Image Generation and Editing","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2606.20100","citing_title":"WeGenBench: A Multidimensional Diagnostic Benchmark towards Text-to-Image Model Optimization","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2606.13289","citing_title":"HYDRA-X: Native Unified Multimodal Models with Holistic Visual Tokenizers","ref_index":212,"is_internal_anchor":false},{"citing_arxiv_id":"2607.01709","citing_title":"COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows","ref_index":56,"is_internal_anchor":false},{"citing_arxiv_id":"2606.12575","citing_title":"High-Fidelity Two-Step Image Generation via Teacher-Aligned End-to-End Distillation","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19839","citing_title":"When Preference Labels Fall Short: Aligning Diffusion Models from Real Data","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19839","citing_title":"When Preference Labels Fall Short: Aligning Diffusion Models from Real Data","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2510.26583","citing_title":"Emu3.5: Native Multimodal Models are World Learners","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.12500","citing_title":"SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2506.15564","citing_title":"Show-o2: Improved Native Unified Multimodal Models","ref_index":13,"is_internal_anchor":false},{"citing_arxiv_id":"2604.22302","citing_title":"Knowledge Visualization: A Benchmark and Method for Knowledge-Intensive Text-to-Image Generation","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2511.22699","citing_title":"Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2604.12163","citing_title":"Nucleus-Image: Sparse MoE for Image Generation","ref_index":43,"is_internal_anchor":false},{"citing_arxiv_id":"2508.02324","citing_title":"Qwen-Image Technical Report","ref_index":5,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57","json":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57.json","graph_json":"https://pith.science/api/pith-number/STWCDIS6JG6QTXYUQW34OSBU57/graph.json","events_json":"https://pith.science/api/pith-number/STWCDIS6JG6QTXYUQW34OSBU57/events.json","paper":"https://pith.science/paper/STWCDIS6"},"agent_actions":{"view_html":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57","download_json":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57.json","view_paper":"https://pith.science/paper/STWCDIS6","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2506.07977&json=true","fetch_graph":"https://pith.science/api/pith-number/STWCDIS6JG6QTXYUQW34OSBU57/graph.json","fetch_events":"https://pith.science/api/pith-number/STWCDIS6JG6QTXYUQW34OSBU57/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57/action/timestamp_anchor","attest_storage":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57/action/storage_attestation","attest_author":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57/action/author_attestation","sign_citation":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57/action/citation_signature","submit_replication":"https://pith.science/pith/STWCDIS6JG6QTXYUQW34OSBU57/action/replication_record"}},"created_at":"2026-07-05T11:27:30.724936+00:00","updated_at":"2026-07-05T11:27:30.724936+00:00"}