Pith. sign in

Paper Citation Record · LEDGER

AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2401.08276.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2401.08276 v1

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 12 of 12 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-10T06:31:04.303077+00:00

measured 12 of 12 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-04T08:15:51.494437Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

6
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation f10a1178-ef77-4fd6-ad54-37a8a2eac59f · inbound

Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models cites this paper.

Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-04T08:15:51.494437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T08:15:51.494437Z digest=sha256:449dbca1031312fa707b06a672c324448bc2bacc7f6ca4ca8d02edc2ab0650da

Observation dfdbdebe-fb74-413d-b857-1f70215a14e2 · inbound

Stable diffusion models reveal a persisting human and AI gap in visual creativity cites this paper.

Stable diffusion models reveal a persisting human and AI gap in visual creativity AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-05-17T20:15:10.453972Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-17T20:13:33.577367Z digest=sha256:84ea331306886ce837de17ff5d7a7540af25e3023effe89d3a5533ca32276217

Observation ed057bbe-e274-4e92-bef8-37aa46ab4330 · inbound

The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor cites this paper.

The Algorithmic Gaze of Image Quality Assessment: An Audit and Trace Ethnography of the LAION-Aesthetics Predictor AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 46

Resolution
verified exact
arxiv_id, observed 2026-05-16T14:07:58.830600Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-16T14:03:00.513248Z digest=sha256:4c912a0ebaa72e6dfcdf123c91c62e68de5f593ee9f9da67942c4faccf590573

Observation cdc64231-7b91-4916-9a7c-d41367bec60b · inbound

What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment? cites this paper.

What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment? AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 3

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T09:16:03.367700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T16:07:39.486278Z digest=sha256:541282b927bfbfccc0dde6816415a9429eb91d8d9a18d3f1a71a0e3f00bb4319

Observation 53eeca0a-9547-4e63-ae04-306198b310aa · inbound

Tunable Polariton Canalization in Natural van der Waals Oxide cites this paper.

Tunable Polariton Canalization in Natural van der Waals Oxide AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 5

Resolution
unresolved
no resolver link, observed 2026-07-12T21:31:36.368963Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-12T21:31:36.368963Z digest=sha256:6d9ed55108b33dafc621b84a6d9c28d722e344d30b02bd0edd5e7ef299bf22d9

Observation 6feb9074-2ca1-43a3-8b4d-b8e7545fff10 · inbound

Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment cites this paper.

Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T10:36:04.775235Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-10T15:24:57.306003Z digest=sha256:aeca7f6720aeb15972b486be9c00ea4a773589381e2d6cabe10c922391a860f2

Observation 5a0f223d-562b-4e09-992a-f7a1e2e95289 · inbound

MultiEmo-Bench: Multi-label Visual Emotion Analysis for Multi-modal Large Language Models cites this paper.

MultiEmo-Bench: Multi-label Visual Emotion Analysis for Multi-modal Large Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 13

Resolution
metadata mismatch
arxiv_id, observed 2026-05-15T05:49:48.010048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-05-15T05:46:58.056363Z digest=sha256:b8376c0f1cf4d25dffe4d4182ff8f17a9b42331c815cc6beac9772f778072fbf

Observation 5911451f-e2b2-4e76-a183-440db95061fb · inbound

PlanBench-V: A Spatial Planning Map Benchmark for Vision-Language Models cites this paper.

PlanBench-V: A Spatial Planning Map Benchmark for Vision-Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 10

Resolution
verified exact
arxiv_id, observed 2026-07-02T12:26:56.345739Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-28T02:10:12.974244Z digest=sha256:a2d42a8c1d8082b596cd4a4601583b430408c26a7724d6bcb97d4d13a0bd54cf

Observation 6995fd78-dc0f-402e-81e9-096123fe0577 · inbound

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models cites this paper.

COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 19

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T10:14:36.379574Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-30T10:10:59.772213Z digest=sha256:6e94651fc96d79fe089da8f2b20644616e18ead534c28fbb7692b6b7f2321a6f

Observation 26e410f7-60e1-471d-842c-afb17610e2fc · inbound

Can MLLMs Critique Like Humans? Evaluating Open-Ended Aesthetic Reasoning in Multimodal Large Language Models cites this paper.

Can MLLMs Critique Like Humans? Evaluating Open-Ended Aesthetic Reasoning in Multimodal Large Language Models AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 11

Resolution
metadata mismatch
arxiv_id, observed 2026-06-30T06:54:20.894790Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.

source=pdf_text observed=2026-06-30T06:46:55.320579Z digest=sha256:b9bd6111b8e45835b6569eca0dbe0d3201a61d5b96ab42d3b9f954d0a5aa5d82

Observation 4a3dba16-dc5a-40bd-9e15-6ff73d6c2ab9 · inbound

Personalized Image Aesthetic Assessment via Preference-rich Sample Mining and Cohort Merging cites this paper.

Personalized Image Aesthetic Assessment via Preference-rich Sample Mining and Cohort Merging AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-01T22:28:23.644746Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-01T22:28:23.644746Z digest=sha256:d73359f6413daba34468b2b9be4a072d01d439882fbbaec6c3956c861f118622

Observation 192a3b2a-fcb1-41e3-ab21-d4c82faa3394 · inbound

What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs cites this paper.

What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-04T02:46:49.750743Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T02:46:49.750743Z digest=sha256:9349e1d1192fa369810185e46c955df1232765f19443ec8cf61dd1445a4f39eb