Pith. sign in

Paper Citation Record · LEDGER

AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2401.08276.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2401.08276 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 14 of 14 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-19T06:32:44.657259+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T12:25:18.462105Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

6
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 431cee1e-e348-40e4-afcd-0bdf18ecdab6 · inbound

HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator cites this paper.

HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-12T12:25:18.462105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T12:25:18.462105Z digest=sha256:02b7a4811fea0d441f8acd40867b7807340ff232e71fc8f09ea7613b2cf6da42

Observation a1111dc9-df06-4dca-9513-a6ceed6dd793 · inbound

Face2QR: A Unified Framework for Aesthetic, Face-Preserving, and Scannable QR Code Generation cites this paper.

Face2QR: A Unified Framework for Aesthetic, Face-Preserving, and Scannable QR Code Generation AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-12T10:28:48.882081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T10:28:48.882081Z digest=sha256:1d25b072f931f3e83740b15f95b31685c6c0784ae094b7c42c25489fe629b0a6

Observation f10a1178-ef77-4fd6-ad54-37a8a2eac59f · inbound

Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models cites this paper.

Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-04T08:15:51.494437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T08:15:51.494437Z digest=sha256:a49eea290215522411d1ba3fc77fe5fb721bd6b0d6334ef1c09b10537fff0ee3

Observation dfdbdebe-fb74-413d-b857-1f70215a14e2 · inbound

Stable diffusion models reveal a persisting human and AI gap in visual creativity cites this paper.

Stable diffusion models reveal a persisting human and AI gap in visual creativity AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-17T20:15:10.453972Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-17T20:13:33.577367Z digest=sha256:8789c449d84d4d52c2ccf128dcbbfe812683ba0d48d6c8aaabdd26ab217e07b0

Observation ed057bbe-e274-4e92-bef8-37aa46ab4330 · inbound

The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor cites this paper.

The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-16T14:07:58.830600Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-16T14:03:00.513248Z digest=sha256:58e5594fe4175b71e7a447813650ddd4e783be21763ffe44c999f1af14578019

Observation cdc64231-7b91-4916-9a7c-d41367bec60b · inbound

What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment? cites this paper.

What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment? AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T09:16:03.367700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-10T16:07:39.486278Z digest=sha256:200f266428f9595f3a0efb8a9d2044fce809609b88f9cdac0f6e9af7b9c0f6a1

Observation 53eeca0a-9547-4e63-ae04-306198b310aa · inbound

Tunable Polariton Canalization in Natural van der Waals Oxide cites this paper.

Tunable Polariton Canalization in Natural van der Waals Oxide AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-12T21:31:36.368963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T21:31:36.368963Z digest=sha256:4a168d3f99c693e1531a04a05a5df133d71840047c14d85836b40dba8df3a560

Observation 6feb9074-2ca1-43a3-8b4d-b8e7545fff10 · inbound

Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment cites this paper.

Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T10:36:04.775235Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-10T15:24:57.306003Z digest=sha256:dd5d495d0f37f04c836a242d0a8303e895b15b17ff1aa4a829bc77def6d05e22

Observation 5a0f223d-562b-4e09-992a-f7a1e2e95289 · inbound

MultiEmo-Bench: Multi-label Visual Emotion Analysis for Multi-modal Large Language Models cites this paper.

MultiEmo-Bench: Multi-label Visual Emotion Analysis for Multi-modal Large Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 13

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T05:49:48.010048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-05-15T05:46:58.056363Z digest=sha256:9f5ca1163f93d0d6a58f14adbe4d0729de8b20e47f9a951c52348abced753096

Observation 5911451f-e2b2-4e76-a183-440db95061fb · inbound

PlanBench-V: A Spatial Planning Map Benchmark for Vision-Language Models cites this paper.

PlanBench-V: A Spatial Planning Map Benchmark for Vision-Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-07-02T12:26:56.345739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-06-28T02:10:12.974244Z digest=sha256:d5c511a21afa0327031fa1179a7908803c82c63a7215d5782b71d7ae4fe0d6ca

Observation 6995fd78-dc0f-402e-81e9-096123fe0577 · inbound

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models cites this paper.

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 19

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T10:14:36.379574Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-06-30T10:10:59.772213Z digest=sha256:ac42ae0f0f414afd2bbb612f1b436f19aa3e90bd97a5d2f9ac41f4f5a57c0b6c

Observation 26e410f7-60e1-471d-842c-afb17610e2fc · inbound

Can MLLMs Critique Like Humans? Evaluating Open-Ended Aesthetic Reasoning in Multimodal Large Language Models cites this paper.

Can MLLMs Critique Like Humans? Evaluating Open-Ended Aesthetic Reasoning in Multimodal Large Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T06:54:20.894790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.

source=pdf_text observed=2026-06-30T06:46:55.320579Z digest=sha256:20772d5ed3a38c84b6e78653e3fdf90592d583e0ca802d08cb63321944d14d5e

Observation 4a3dba16-dc5a-40bd-9e15-6ff73d6c2ab9 · inbound

Personalized Image Aesthetic Assessment via Preference-rich Sample Mining and Cohort Merging cites this paper.

Personalized Image Aesthetic Assessment via Preference-rich Sample Mining and Cohort Merging AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-01T22:28:23.644746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T22:28:23.644746Z digest=sha256:8134d0765551b0017e0ae1292e22e45057723b15d0a96cf8cf8cd1aa424a7025

Observation 192a3b2a-fcb1-41e3-ab21-d4c82faa3394 · inbound

What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs cites this paper.

What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-04T02:46:49.750743Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T02:46:49.750743Z digest=sha256:94e833800d72b7722d4783f25558499f601651264cfb9fd51cc8b3ef7f8995de