{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:67Y4C44MLWWKXKHXBDHUZA4I5X","short_pith_number":"pith:67Y4C44M","schema_version":"1.0","canonical_sha256":"f7f1c1738c5dacaba8f708cf4c8388edcbb7a9c27b99bb86861b5c859e55264b","source":{"kind":"arxiv","id":"2505.16832","version":2},"attestation_state":"computed","paper":{"title":"From EduVisBench to EduVisAgent: A Benchmark and Multi-Agent Framework for Reasoning-Driven Pedagogical Visualization","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CL","cs.CV","cs.LG"],"primary_cat":"cs.AI","authors_text":"Dake Zhang, Haonian Ji, Hongyi Wang, Huaxiu Yao, Shi Qiu, Siwei Han, Siyang Xin, Zhaorun Chen","submitted_at":"2025-05-22T16:02:18Z","abstract_excerpt":"While foundation models (FMs), such as diffusion models and large vision-language models (LVLMs), have been widely applied in educational contexts, their ability to generate pedagogically effective visual explanations remains limited. Most existing approaches focus primarily on textual reasoning, overlooking the critical role of structured and interpretable visualizations in supporting conceptual understanding. To better assess the visual reasoning capabilities of FMs in educational settings, we introduce EduVisBench, a multi-domain, multi-level benchmark. EduVisBench features diverse STEM pro"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2505.16832","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.AI","submitted_at":"2025-05-22T16:02:18Z","cross_cats_sorted":["cs.CL","cs.CV","cs.LG"],"title_canon_sha256":"d5d4d2c67d69a603e3ac0328a5dd9aa8d3a6c6ee89b8ef77a230b119a139bb5d","abstract_canon_sha256":"74966df9112c999a174609c0a6e8534ef5f13234e4fe45b5eb6b907c94b1930a"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:10:57.439715Z","signature_b64":"YYu/LGz7uTr4ONDPBjX7pIazeybX7M4lmFRgmk8DHj9+oP3+MeIV+01Dioy3MAj2I0YW+qYr83c48iGYSqZOAA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"f7f1c1738c5dacaba8f708cf4c8388edcbb7a9c27b99bb86861b5c859e55264b","last_reissued_at":"2026-07-05T11:10:57.439187Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:10:57.439187Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"From EduVisBench to EduVisAgent: A Benchmark and Multi-Agent Framework for Reasoning-Driven Pedagogical Visualization","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CL","cs.CV","cs.LG"],"primary_cat":"cs.AI","authors_text":"Dake Zhang, Haonian Ji, Hongyi Wang, Huaxiu Yao, Shi Qiu, Siwei Han, Siyang Xin, Zhaorun Chen","submitted_at":"2025-05-22T16:02:18Z","abstract_excerpt":"While foundation models (FMs), such as diffusion models and large vision-language models (LVLMs), have been widely applied in educational contexts, their ability to generate pedagogically effective visual explanations remains limited. Most existing approaches focus primarily on textual reasoning, overlooking the critical role of structured and interpretable visualizations in supporting conceptual understanding. To better assess the visual reasoning capabilities of FMs in educational settings, we introduce EduVisBench, a multi-domain, multi-level benchmark. EduVisBench features diverse STEM pro"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2505.16832","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2505.16832/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2505.16832","created_at":"2026-07-05T11:10:57.439246+00:00"},{"alias_kind":"arxiv_version","alias_value":"2505.16832v2","created_at":"2026-07-05T11:10:57.439246+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2505.16832","created_at":"2026-07-05T11:10:57.439246+00:00"},{"alias_kind":"pith_short_12","alias_value":"67Y4C44MLWWK","created_at":"2026-07-05T11:10:57.439246+00:00"},{"alias_kind":"pith_short_16","alias_value":"67Y4C44MLWWKXKHX","created_at":"2026-07-05T11:10:57.439246+00:00"},{"alias_kind":"pith_short_8","alias_value":"67Y4C44M","created_at":"2026-07-05T11:10:57.439246+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":3,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2604.04202","citing_title":"ClawArena: Benchmarking AI Agents in Evolving Information Environments","ref_index":1,"is_internal_anchor":false},{"citing_arxiv_id":"2605.15585","citing_title":"See Before You Code: Learning Visual Priors for Spatially Aware Educational Animation Generation","ref_index":46,"is_internal_anchor":false},{"citing_arxiv_id":"2604.09691","citing_title":"CAGE: Bridging the Accuracy-Aesthetics Gap in Educational Diagrams via Code-Anchored Generative Enhancement","ref_index":9,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X","json":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X.json","graph_json":"https://pith.science/api/pith-number/67Y4C44MLWWKXKHXBDHUZA4I5X/graph.json","events_json":"https://pith.science/api/pith-number/67Y4C44MLWWKXKHXBDHUZA4I5X/events.json","paper":"https://pith.science/paper/67Y4C44M"},"agent_actions":{"view_html":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X","download_json":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X.json","view_paper":"https://pith.science/paper/67Y4C44M","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2505.16832&json=true","fetch_graph":"https://pith.science/api/pith-number/67Y4C44MLWWKXKHXBDHUZA4I5X/graph.json","fetch_events":"https://pith.science/api/pith-number/67Y4C44MLWWKXKHXBDHUZA4I5X/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X/action/timestamp_anchor","attest_storage":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X/action/storage_attestation","attest_author":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X/action/author_attestation","sign_citation":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X/action/citation_signature","submit_replication":"https://pith.science/pith/67Y4C44MLWWKXKHXBDHUZA4I5X/action/replication_record"}},"created_at":"2026-07-05T11:10:57.439246+00:00","updated_at":"2026-07-05T11:10:57.439246+00:00"}