{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:VGXYTU55CI4DH3HMLVY4AISUVR","short_pith_number":"pith:VGXYTU55","schema_version":"1.0","canonical_sha256":"a9af89d3bd123833ecec5d71c02254ac6a51e323db4d4d6e23a1a8ea4df337cb","source":{"kind":"arxiv","id":"2507.14533","version":2},"attestation_state":"computed","paper":{"title":"ArtiMuse: Fine-Grained Image Aesthetics Assessment with Joint Scoring and Expert-Level Understanding","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Bo Qu, Dajuin Yao, Jiaquan Wang, Jiarui Wu, Jiayang Li, Kaiwen Zhu, Lihao Shao, Nan Ma, Shuo Cao, Wenhai Wang, Xiaohui Li, Yihao Liu, Yuandong Pu, Yu Qiao, Yu Zhou","submitted_at":"2025-07-19T08:27:21Z","abstract_excerpt":"The rapid advancement of educational applications, artistic creation, and AI-generated content (AIGC) technologies has substantially increased practical requirements for comprehensive Image Aesthetics Assessment (IAA), particularly demanding methods capable of delivering both quantitative scoring and professional understanding. Multimodal Large Language Model (MLLM)-based IAA methods demonstrate stronger perceptual and generalization capabilities compared to traditional approaches, yet they suffer from modality bias (score-only or text-only) and lack fine-grained attribute decomposition, there"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2507.14533","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2025-07-19T08:27:21Z","cross_cats_sorted":[],"title_canon_sha256":"bb26ae158526c4b75f1a195190b6b0b571b5b3d95b88e51f69bc58ad4663c35b","abstract_canon_sha256":"885bb516dce6986e66b4f1ab3aca8776dcfac68cd66a6f06f4de796ae0851d01"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:51:32.318646Z","signature_b64":"8WhedGorEnKeY+dgrC37/FdngSWZU6u1HZTPJvHIjlJ3W1a+CbFjXUovpuUotXTFX+kx+70JDTY4qs5eUSy/CA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"a9af89d3bd123833ecec5d71c02254ac6a51e323db4d4d6e23a1a8ea4df337cb","last_reissued_at":"2026-07-05T11:51:32.318151Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:51:32.318151Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"ArtiMuse: Fine-Grained Image Aesthetics Assessment with Joint Scoring and Expert-Level Understanding","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Bo Qu, Dajuin Yao, Jiaquan Wang, Jiarui Wu, Jiayang Li, Kaiwen Zhu, Lihao Shao, Nan Ma, Shuo Cao, Wenhai Wang, Xiaohui Li, Yihao Liu, Yuandong Pu, Yu Qiao, Yu Zhou","submitted_at":"2025-07-19T08:27:21Z","abstract_excerpt":"The rapid advancement of educational applications, artistic creation, and AI-generated content (AIGC) technologies has substantially increased practical requirements for comprehensive Image Aesthetics Assessment (IAA), particularly demanding methods capable of delivering both quantitative scoring and professional understanding. Multimodal Large Language Model (MLLM)-based IAA methods demonstrate stronger perceptual and generalization capabilities compared to traditional approaches, yet they suffer from modality bias (score-only or text-only) and lack fine-grained attribute decomposition, there"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.14533","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2507.14533/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2507.14533","created_at":"2026-07-05T11:51:32.318214+00:00"},{"alias_kind":"arxiv_version","alias_value":"2507.14533v2","created_at":"2026-07-05T11:51:32.318214+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.14533","created_at":"2026-07-05T11:51:32.318214+00:00"},{"alias_kind":"pith_short_12","alias_value":"VGXYTU55CI4D","created_at":"2026-07-05T11:51:32.318214+00:00"},{"alias_kind":"pith_short_16","alias_value":"VGXYTU55CI4DH3HM","created_at":"2026-07-05T11:51:32.318214+00:00"},{"alias_kind":"pith_short_8","alias_value":"VGXYTU55","created_at":"2026-07-05T11:51:32.318214+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":17,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.05778","citing_title":"Beyond Absolute Scores: Relative Edit-induced Difference for Generalizable Image Aesthetic Assessment","ref_index":8,"is_internal_anchor":false},{"citing_arxiv_id":"2606.05778","citing_title":"Beyond Absolute Scores: Relative Edit-induced Difference for Generalizable Image Aesthetic Assessment","ref_index":8,"is_internal_anchor":false},{"citing_arxiv_id":"2605.25661","citing_title":"DRM: Diffusion-based Reward Model With Step-wise Guidance","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2605.23518","citing_title":"VINS-120K: Ultra High-Resolution Image Editing with A Large-Scale Dataset","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2605.22126","citing_title":"AesFormer: Transform Everyday Photos into Beautiful Memories","ref_index":3,"is_internal_anchor":false},{"citing_arxiv_id":"2605.04128","citing_title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","ref_index":11,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19776","citing_title":"Preferences Order, Ratings Anchor: From Fused Expert Aesthetic Ground Truth to Self-Distillation","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19776","citing_title":"Preferences Order, Ratings Anchor: From Fused Expert Aesthetic Ground Truth to Self-Distillation","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.20147","citing_title":"PixVerve: Advancing Native UHR Image Generation to 100MP with a Large-Scale High-Quality Dataset","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2512.00993","citing_title":"PhotoFramer: Multi-modal Image Composition Instruction","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2604.03611","citing_title":"PortraitCraft: A Benchmark for Portrait Composition Understanding and Generation","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2605.06170","citing_title":"DynT2I-Eval: A Dynamic Evaluation Framework for Text-to-Image Models","ref_index":3,"is_internal_anchor":false},{"citing_arxiv_id":"2604.08641","citing_title":"On Semiotic-Grounded Interpretive Evaluation of Generative Art","ref_index":10,"is_internal_anchor":false},{"citing_arxiv_id":"2604.17850","citing_title":"UniCSG: Unified High-Fidelity Content-Constrained Style-Driven Generation via Staged Semantic and Frequency Disentanglement","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16958","citing_title":"Self-Reasoning Agentic Framework for Narrative Product Grid-Collage Generation","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2604.20796","citing_title":"LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2605.04128","citing_title":"JoyAI-Image: Awaking Spatial Intelligence in Unified Multimodal Understanding and Generation","ref_index":11,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR","json":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR.json","graph_json":"https://pith.science/api/pith-number/VGXYTU55CI4DH3HMLVY4AISUVR/graph.json","events_json":"https://pith.science/api/pith-number/VGXYTU55CI4DH3HMLVY4AISUVR/events.json","paper":"https://pith.science/paper/VGXYTU55"},"agent_actions":{"view_html":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR","download_json":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR.json","view_paper":"https://pith.science/paper/VGXYTU55","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2507.14533&json=true","fetch_graph":"https://pith.science/api/pith-number/VGXYTU55CI4DH3HMLVY4AISUVR/graph.json","fetch_events":"https://pith.science/api/pith-number/VGXYTU55CI4DH3HMLVY4AISUVR/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR/action/timestamp_anchor","attest_storage":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR/action/storage_attestation","attest_author":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR/action/author_attestation","sign_citation":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR/action/citation_signature","submit_replication":"https://pith.science/pith/VGXYTU55CI4DH3HMLVY4AISUVR/action/replication_record"}},"created_at":"2026-07-05T11:51:32.318214+00:00","updated_at":"2026-07-05T11:51:32.318214+00:00"}