{"as_of":"2026-08-07T17:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6139731ed72b5aea43701b3cdda39c68c923e5811079b7e4558880a5361db535","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:59:25.508500Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03385/citation-record","integrity":"/paper/2509.03385/integrity","json":"/paper/2509.03385/citation-record.json","paper":"/paper/2509.03385"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.658734Z","title":"HRS-Bench: Holistic, Reliable and Scalable Benchmark for Text-to-Image Models","venue":null,"work_id":"a3a45449-5e9e-4d94-81ef-da71f9592e73","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.187981Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:602125e717cc005037acf3b9632f1408f3c91a0eaaeef309aec3483767592102","observation_id":"c599ab3c-c612-4883-8b18-501770399f70","resolution":{"observed_at":"2026-08-05T10:59:26.663617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.642858Z","title":"Videophy: Evaluating phys- ical commonsense for video generation","venue":null,"work_id":"6e6ee60e-3880-4d3c-b52c-daf087c78f32","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.193027Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:6949956a542c6aa96c54254ae2d8c1e89c420db6aafcc8a40f6227c9175d67c0","observation_id":"fe314d61-6a32-40d5-b0c2-f66bac030e41","resolution":{"observed_at":"2026-08-05T10:59:26.647748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-07T17:18:26.824890Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-08-05T10:59:25.198610Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evalua- tion in Video Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.198610Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:a71933f8e7fff445a13c197a1ffeb8fa109f056b04eef0c8155b7faa020bb34a","observation_id":"8814fc66-f840-41c2-83fd-f5297fd85d97","resolution":{"observed_at":"2026-08-05T10:59:25.198610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.627655Z","title":"Parkhi, and An- drew Zisserman","venue":null,"work_id":"5830f43a-f3b3-490b-8bdd-cf2e581c73b5","year":2018},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.203814Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:99ea22d02fa35e43c370069aa79e51e8b05125fddd165b65c163a77e96c6f673","observation_id":"436c24cc-d651-43ff-bdc5-a4b83f42f5be","resolution":{"observed_at":"2026-08-05T10:59:26.633066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.611508Z","title":"Emerg- ing Properties in Self-Supervised Vision Transformers","venue":null,"work_id":"17313b88-1232-4ada-af90-5df2bcc83ad7","year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.209330Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:db9c1fe86eb5a02988829bfe75220c26083c560937b47ed6884f8af94e48150f","observation_id":"bd40603b-14ea-4f75-9068-b28bf4deb1d9","resolution":{"observed_at":"2026-08-05T10:59:26.617217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.596128Z","title":"AnyDoor: Zero-shot Object-level Image Customization","venue":null,"work_id":"aed0405f-4c0f-41a8-950d-a12ac0cbd4d3","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.214269Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:52d75269eb4461d9173ec3b3839d2443bb4416bf8d6499eb4d1f0472d8c0e036","observation_id":"f62c2a79-0b4e-4adf-9dcc-61ab2af8e0ec","resolution":{"observed_at":"2026-08-05T10:59:26.601577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.581164Z","title":"DALL-EV AL: Probing the Reasoning Skills and Social Biases of Text-to- Image Generation Models","venue":null,"work_id":"bd6e2508-75a3-4d5a-ae20-ae6084749956","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.219122Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:169bd6fbe6c64de0615485c0780be68f436cbe2f25c21d8751326c367317dd0d","observation_id":"54747dfa-2a88-4180-929e-69e065574e52","resolution":{"observed_at":"2026-08-05T10:59:26.585995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.565487Z","title":"ArcFace: Additive Angu- lar Margin Loss for Deep Face Recognition","venue":null,"work_id":"ac9a65a6-f0f3-4505-bb66-9c4bc6c8dd38","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.224574Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:4694589c4985572cd65bb8067e55a27bc23dd6f084799fa56c549742137361dd","observation_id":"63f50de2-f1ed-42ae-ae7e-e849a234b566","resolution":{"observed_at":"2026-08-05T10:59:26.570583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10015","last_updated":"2023-10-27T17:24:04Z","snapshot_observed_at":"2026-07-06T14:32:48.360720Z","submitted_at":"2022-12-20T06:03:51Z","title":"Benchmarking Spatial Relationships in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10015","snapshot_observed_at":"2026-08-05T10:59:25.229741Z","title":"Benchmarking spatial relationships in text-to-image generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.229741Z"},"links":{"cited_paper":"/paper/2212.10015","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:65e4788e6aa1e889e1509a3ddf785ee1aa874b70ea30d3b6acf6d54005125e29","observation_id":"a5df3ae9-484b-47a3-9946-033742454da1","resolution":{"observed_at":"2026-08-05T10:59:25.229741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.550056Z","title":"GIQA: Generated Image Quality Assessment","venue":null,"work_id":"0c13852b-23fd-409c-8f0d-a04f6ee845cf","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.234736Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0b059bcd341b07b7a4f065cb3a0a4b1d75e2583e4ef23fc0a7146a37e3c12a68","observation_id":"6ef0bf28-e169-43e9-a899-5f92a5de5cc9","resolution":{"observed_at":"2026-08-05T10:59:26.554873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.534528Z","title":"Mix-of-show: decentralized low-rank adaptation for multi-concept customization of diffusion models","venue":null,"work_id":"8e194108-55e9-4eed-b81f-9c2ccd47e116","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.239886Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ee7e544e16e98ccb2e58e6973a072a5e0e4faf73629064766f96064f2b6769d3","observation_id":"0933f34a-9495-479c-8e7e-db86aa8b683d","resolution":{"observed_at":"2026-08-05T10:59:26.539635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05939","last_updated":"2024-09-06T14:44:12Z","snapshot_observed_at":"2026-07-06T18:59:29.568123Z","submitted_at":"2024-08-12T06:27:29Z","title":"UniPortrait: A Unified Framework for Identity-Preserving Single- and Multi-Human Image Personalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05939","snapshot_observed_at":"2026-08-05T10:59:25.244664Z","title":"UniPor- trait: A Unified Framework for Identity-Preserving Single- and Multi-Human Image Personalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.244664Z"},"links":{"cited_paper":"/paper/2408.05939","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:141ee9f73160ddd62a1e35fe840686114c2c811cb9bac85966e0b73095c345e1","observation_id":"b7fa93cb-8760-4faf-967d-0a014dc220f7","resolution":{"observed_at":"2026-08-05T10:59:25.244664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.517647Z","title":"VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feed- back for Video Generation","venue":null,"work_id":"d66c0eac-3e4f-40ed-98b9-b5beaacd7f5e","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.249939Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:21b11f8307d5c511b51d55e05435b898a8c571bff16fea3d69c6a0c44d6506d3","observation_id":"cdabd181-aaa1-456d-8f61-a0f31768d0ef","resolution":{"observed_at":"2026-08-05T10:59:26.523520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.501931Z","title":"Seman- tic Object Accuracy for Generative Text-to-Image Synthesis","venue":null,"work_id":"40818d67-737c-4468-b933-4b61ff7d6159","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.255013Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:5d3761f44fcc7e97b3bb536fdb6bf5c8e4ca07ee9b05d29068448834e943984d","observation_id":"c400a9e7-e3dc-4964-80ee-7610cd6cbc51","resolution":{"observed_at":"2026-08-05T10:59:26.507211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.485231Z","title":"Denoising Dif- fusion Probabilistic Models","venue":null,"work_id":"bb97620d-c8d6-4792-b3ad-8c866eb9a94b","year":2020},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.259730Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:4df3eafb27e1ac04496abd59a7986396b76957d23ff211c3332681f948c932d7","observation_id":"0d19bca6-a49e-4ea0-9d22-c04eb1d84e7e","resolution":{"observed_at":"2026-08-05T10:59:26.491431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.470371Z","title":null,"venue":null,"work_id":"21246392-0c1c-4cf8-9d90-3157046a6a71","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.264935Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:abab8bcb3d783ff3408d613f5431445b99d11ee32617b62ae09e12a4b7ee375b","observation_id":"e5c2a792-cb9b-42c2-a13a-5192bc06fe8a","resolution":{"observed_at":"2026-08-05T10:59:26.474939Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.455381Z","title":"A Style- Based Generator Architecture for Generative Adversarial Networks","venue":null,"work_id":"74850c9e-be3d-4e85-b004-1d149303652f","year":2019},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.269577Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:d61024e55b5137340b3256151b51e354ecc9f4a2f38c7440cfe2c955c766fce0","observation_id":"0fd10c35-bcc7-4428-b92d-5bc9dd89c0d9","resolution":{"observed_at":"2026-08-05T10:59:26.460578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.440180Z","title":"Berg, Wan-Yen Lo, Piotr Dollar, and Ross Girshick","venue":null,"work_id":"c4550e4d-0770-4932-901d-6177fda6bde2","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.274027Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ebecf9c8ba57866cd704a29bfff5ed33a6f9df52dded711f157f7f71c15cca63","observation_id":"cfa95bba-5eac-4dd7-8e7e-99e2c24d4ce2","resolution":{"observed_at":"2026-08-05T10:59:26.444801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.424868Z","title":"OMG: Occlusion-Friendly Personalized Multi-concept Generation in Diffusion Models","venue":null,"work_id":"df28dfd3-8013-4a6d-ad35-2f2f3dc2d5b3","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.278802Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:5cc32f88a37e029b3ad01e5f2366fbd71145e04c593b33a478adcbb0c3509994","observation_id":"3a77c6a7-ad7d-47e8-8b65-d66da8fabaa5","resolution":{"observed_at":"2026-08-05T10:59:26.430358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.409440Z","title":"VIEScore: Towards explainable metrics for condi- tional image synthesis evaluation","venue":null,"work_id":"c43ae175-a23c-47f5-9fe7-4255ea97905f","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.283680Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b90a3b85db376e8fa74afafc30df0099360b7b682e42d6cd3417931b6993a558","observation_id":"7185352c-f22e-450c-9ef6-e7513fdf3668","resolution":{"observed_at":"2026-08-05T10:59:26.413974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.394279Z","title":"Imagenhub: Standardizing the evaluation of conditional image generation models","venue":null,"work_id":"8e09112a-71f9-4be6-a25a-82f679ce663c","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.288008Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:687b358bb4dc22e033ff23ba8fdc4898d8c60c74f3162e62a5f0e9d39552addb","observation_id":"4ef2092d-9a26-4022-bf8e-cdd5f2d043f5","resolution":{"observed_at":"2026-08-05T10:59:26.399008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.378834Z","title":"Multi-Concept Customization of Text-to-Image Diffusion","venue":null,"work_id":"e5212cff-4861-4067-bd9b-0fc1a2abc2a7","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.293088Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:91658b78048adc8d17b179c647d2fed6ce54245dbd7a1259ae059458060c65c9","observation_id":"0c69c52d-21df-4845-9d2d-9e7c35e6f23f","resolution":{"observed_at":"2026-08-05T10:59:26.383673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.363616Z","title":null,"venue":null,"work_id":"b7ffd89c-d607-46d5-a8fb-365dc654779e","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.297638Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:553248a7267cfcb1a13e90e8108fd549abda8569f86b142d8940710b6bf9240f","observation_id":"4254ded7-fb9f-46a6-b9b8-59ce91340016","resolution":{"observed_at":"2026-08-05T10:59:26.368536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.349136Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","venue":null,"work_id":"93d783cf-94a5-415f-8212-e4fd5bb0008a","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.302212Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:1f1db82b56e10b5e4c249f1bc774761c831116eacfe00c662072b9501234c282","observation_id":"1c7f0bec-e10a-49f6-b1af-d216dc26a2af","resolution":{"observed_at":"2026-08-05T10:59:26.353779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.333738Z","title":"Image Synthesis From Layout With Locality- Aware Mask Adaption","venue":null,"work_id":"2ba13f7b-b6f2-43bc-a10a-4e13448db468","year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.306995Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0407f343b68a7d47583743b3037a981db3921bf484769ee2e3da7edc6a0beca1","observation_id":"f97036b4-8a8a-4d9f-8cd7-a96db6eb84c6","resolution":{"observed_at":"2026-08-05T10:59:26.338693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.318897Z","title":"Lawrence Zitnick","venue":null,"work_id":"8488055c-af6f-484f-b37b-933d29e7f97c","year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.312019Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:2c333fb99112d0d557bfd2e9f896486ebe5709572b81a7d3ab495b343d37cf8a","observation_id":"0c7e291c-f3cc-4441-a1ff-ab1d7d8c8332","resolution":{"observed_at":"2026-08-05T10:59:26.323590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.303642Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":"f0d892c4-b65a-451e-9550-65eb09051fb1","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.316997Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:38d6495672f1127dca02a89513c9e0cc3cd7fd82bc669517f36142d84be2ad69","observation_id":"f1fdb08f-4581-40d2-9558-0a8d039a4d33","resolution":{"observed_at":"2026-08-05T10:59:26.308597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.286480Z","title":null,"venue":null,"work_id":"65001262-4cc2-4b35-b049-6c26d8755157","year":2020},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.321649Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:bd5ea45bee8e30901af6a736f91c0db14549ee881db83a94966749a6cd5b5c80","observation_id":"65365a27-bc55-4c44-a451-893ecef85dcb","resolution":{"observed_at":"2026-08-05T10:59:26.291931Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.270871Z","title":"Grounding dino: Marry- ing dino with grounded pre-training for open-set object de- tection","venue":null,"work_id":"1dbd46b2-b1b0-45d3-8b02-8841305434f2","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.326325Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:fc2543124e98bcbc7319515d5dad5fbd4daf5f317c90ec0cb19fefe379a11118","observation_id":"435c8c57-80e3-4ac0-bcdf-f3ef62fde7e8","resolution":{"observed_at":"2026-08-05T10:59:26.275665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.256094Z","title":"Cones 2: customizable image synthesis with multiple subjects","venue":null,"work_id":"c1c5c8b9-c0b5-4950-bb3d-8b0849ee794e","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.331202Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:3206063bafb07a6e5ea3829144ce45c30b607f212f898f123dbf52201604724a","observation_id":"55597837-c55b-4635-9058-cb6cfa2b3f21","resolution":{"observed_at":"2026-08-05T10:59:26.260864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.240680Z","title":"Subject- Diffusion: Open Domain Personalized Text-to-Image Gener- ation without Test-time Fine-tuning","venue":null,"work_id":"2ba2f963-c961-44f4-b914-13b4b8635742","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.335795Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:c830f1d2c09e6e69e45bdb4e19674eede7e5649d9cb1e3c5f74cefaf5c961c4d","observation_id":"2c36f1ff-1a21-4d45-92b6-f84185677af2","resolution":{"observed_at":"2026-08-05T10:59:26.246063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.225172Z","title":"Towards a Bet- ter Metric for Evaluating Question Generation Systems","venue":null,"work_id":"914e28a9-c6d4-4363-a49f-fd3023535fb5","year":2018},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.340987Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:55cb34f8a8db60dc2a216c3e4cc254fd6e33d4eda0e46d9721113240b5a8ff8e","observation_id":"99ba8989-f8a4-4360-8e94-f691aeca2990","resolution":{"observed_at":"2026-08-05T10:59:26.230109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.345690Z","title":"Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.345690Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:8178f2749e064557bd36d5edf065ec27b6d84a4f223af956af315cd9156ba6ac","observation_id":"f3729ba3-2a8f-42ff-9c0a-1f27c838bfb2","resolution":{"observed_at":"2026-08-05T10:59:25.345690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T10:59:25.350517Z","title":"GPT-4 Technical Report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.350517Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:769d68b71513cf3133c51af48521ee6ec29535a359bcaa50808b29b1cb23b459","observation_id":"0021bc9e-f327-4c84-b363-dfadf2486494","resolution":{"observed_at":"2026-08-05T10:59:25.350517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.209293Z","title":"Dreambench++: A human-aligned bench- mark for personalized image generation","venue":null,"work_id":"8f66a3b4-19f9-4977-ae76-995687bfe6f2","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.355680Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:05ca16367e1ddea44286d17433370a1cb04c75d241cc0078cf47d41bea6cdcf0","observation_id":"f61ba8c5-6e60-44e5-9244-488b322575fa","resolution":{"observed_at":"2026-08-05T10:59:26.214960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.194325Z","title":"Grounded Text-to-Image Synthesis with Attention Refocusing","venue":null,"work_id":"6abf28c5-8039-48b1-97e0-4cfd1c1d44fb","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.360671Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:22089bb6b4941db633d18c34b9e9916cce379c8e986c5e814a861196de6e31f8","observation_id":"a15a48e3-7f38-4583-a64c-babd0c1768e0","resolution":{"observed_at":"2026-08-05T10:59:26.198993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.179110Z","title":"Plummer, Liwei Wang, Chris M","venue":null,"work_id":"e676d729-623b-451f-af10-dd6104312739","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.365139Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:fa57fde55e88814a455d5f510a012ccfca277313546628c58111ac483b893bd5","observation_id":"0399363f-4586-4a42-9ab3-7afffbf0b934","resolution":{"observed_at":"2026-08-05T10:59:26.184213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T10:59:25.370039Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.370039Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:3cb269a33e90edd9be20c36c47c4c1e559843ce7743716779b8846662d673460","observation_id":"0868e31e-b2fe-4ff4-83f1-1417e4a43085","resolution":{"observed_at":"2026-08-05T10:59:25.370039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.163845Z","title":"Learning Transferable Visual Models From Natural Language Supervision","venue":null,"work_id":"0b7edda4-32ae-41b8-84a3-613c71d2b1ba","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.375259Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0ca070b54ff4edbb4c1a70fc94c5bb9a1ef6f9b5a0c0cb42b73d0c1de67955c3","observation_id":"c8adedfb-a5c9-4a29-886a-feb4fca7d415","resolution":{"observed_at":"2026-08-05T10:59:26.169106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.147652Z","title":"High-Resolution Image Synthesis With Latent Diffusion Models","venue":null,"work_id":"6c1d771f-7714-4b69-920a-b899d87c9d1f","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.380273Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:30989cabd54549fa6a129d7d67f8c7bb97bb4a52393cce8c5fc5444b704b4d3d","observation_id":"dbfb5981-7c40-40e7-a3fe-9ff608c2c226","resolution":{"observed_at":"2026-08-05T10:59:26.152731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.129159Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"56da0817-8e49-4115-b42e-e0c2319c61cf","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.385752Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:9b7fdf0fb2a212d09b16dc953dbcf64787a65c696c88edcc78cac92f12ad6885","observation_id":"ce38188d-23e6-4b2e-a94c-f23b62719e35","resolution":{"observed_at":"2026-08-05T10:59:26.134183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.113566Z","title":"Sara Mahdavi, Raphael Gontijo-Lopes, Tim Salimans, Jonathan Ho, David J Fleet, and Mohammad Norouzi","venue":null,"work_id":"69190162-51a5-4c55-90c6-33b66370cc2d","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.390333Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:490a5d3d9f2a88b455324e0bb270901034c471f0aba4290bdb9452d93771f114","observation_id":"2935ac23-a612-4ea3-8cbe-23ad47fd9f3e","resolution":{"observed_at":"2026-08-05T10:59:26.118688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-05T10:59:25.396135Z","title":"LAION- 400M: Open Dataset of CLIP-Filtered 400 Million Image- Text Pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.396135Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:a66c5e121799d1111cb75718198d2fc38a3693602f86a4d0e7682f4a890d1e85","observation_id":"b0006f67-5ed1-4863-858d-c4dfa3b7dfd2","resolution":{"observed_at":"2026-08-05T10:59:25.396135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.08402","last_updated":"2022-10-16T00:08:18Z","snapshot_observed_at":"2026-07-29T21:51:47.064287Z","submitted_at":"2022-10-16T00:08:18Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.08402","snapshot_observed_at":"2026-08-05T10:59:25.401255Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.401255Z"},"links":{"cited_paper":"/paper/2210.08402","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:edecf7b10cb6368727ddbc6a9e6b83445bc4fddfec74bbc04b3519facfaa1dc7","observation_id":"298eef0a-a9b1-4daa-aeac-a70f9402e00c","resolution":{"observed_at":"2026-08-05T10:59:25.401255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.096012Z","title":"NTU RGB+D: A Large Scale Dataset for 3D Human Activ- ity Analysis","venue":null,"work_id":"013e663c-ae7a-4b84-8832-3d5c3624b047","year":2016},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.406793Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:e0d25d6d329cfc5892efe96d4711aed050934206f032c22ca0d9e0df7e4c36b2","observation_id":"8cb8850a-fa4b-4324-adff-8488e2b1de30","resolution":{"observed_at":"2026-08-05T10:59:26.101967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.080662Z","title":"Weiss, Niru Mah- eswaranathan, and Surya Ganguli","venue":null,"work_id":"e84c2d3f-42c1-4645-9c1c-eebcced8e4ca","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.411402Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:5dc9caede8d6d4ae9aecfd5afd5b3bda0935c82d7e2bc071d245b714a7d4af27","observation_id":"316cc1f5-4345-4df9-9c41-80115dbd09fa","resolution":{"observed_at":"2026-08-05T10:59:26.085634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.4842","last_updated":"2014-09-17T01:03:11Z","snapshot_observed_at":"2026-07-06T03:54:42.722883Z","submitted_at":"2014-09-17T01:03:11Z","title":"Going Deeper with Convolutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.4842","snapshot_observed_at":"2026-08-05T10:59:25.416483Z","title":"Going Deeper with Convolutions","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.416483Z"},"links":{"cited_paper":"/paper/1409.4842","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:61e19cf063651c3961b0849676a3213eb9fde54613c9432f9abc193aa55e72e6","observation_id":"429402f3-bc08-4b5d-aec4-aaeffbd7ca3b","resolution":{"observed_at":"2026-08-05T10:59:25.416483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T10:59:25.421373Z","title":"Dai, Anja Hauth, Katie Millican, and David Sil- ver et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.421373Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:53230da4cbfc762388da341fd146d6219ab399b1829e142e4e41e74e51159213","observation_id":"ebe11196-7118-4759-89a1-0f032d7d2bfa","resolution":{"observed_at":"2026-08-05T10:59:25.421373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.064954Z","title":"Diffusers: State-of-the-art diffusion models","venue":null,"work_id":"c31fee18-8214-46aa-ac97-9821ec62f192","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.427277Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:bfe5af7fadee70f9556a365fca59b99142ee2a7921dc9ce5d9504ff5c9aa9b05","observation_id":"d23d6a0f-4a28-46b2-afd7-f564ee6eafa7","resolution":{"observed_at":"2026-08-05T10:59:26.070226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09522","last_updated":"2023-07-15T15:48:48Z","snapshot_observed_at":"2026-08-06T13:58:29.349698Z","submitted_at":"2023-03-16T17:38:15Z","title":"P+: Extended Textual Conditioning in Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09522","snapshot_observed_at":"2026-08-05T10:59:25.431963Z","title":"P+: Extended Textual Conditioning in Text-to- Image Generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.431963Z"},"links":{"cited_paper":"/paper/2303.09522","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:f261b099853a174c79e62388debffa544c06a63a101f2abb84a60c53d109409e","observation_id":"07aec872-ed83-48f3-9d7c-e1616c3be7f7","resolution":{"observed_at":"2026-08-05T10:59:25.431963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17221","last_updated":"2024-11-26T08:43:15Z","snapshot_observed_at":"2026-07-06T19:57:10.411888Z","submitted_at":"2024-11-26T08:43:15Z","title":"AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM","version":1},"cited_work":{"arxiv_id":"2411.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17221","snapshot_observed_at":"2026-08-05T10:59:25.625707Z","title":"AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM","venue":"cs.CV","work_id":"3b524383-ac7b-4934-9807-b89a7977c58b","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.437314Z"},"links":{"cited_paper":"/paper/2411.17221","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:5a1e9bdce65f8e3c0527b486ef7ccd653ab1f4d4af499e851e71833f9019b78d","observation_id":"38528513-0f4a-490c-a1e8-48f336dae96c","resolution":{"observed_at":"2026-08-05T10:59:25.630556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07046","last_updated":"2025-04-09T17:04:14Z","snapshot_observed_at":"2026-08-07T16:07:07.841461Z","submitted_at":"2025-04-09T17:04:14Z","title":"A Unified Agentic Framework for Evaluating Conditional Image Generation","version":1},"cited_work":{"arxiv_id":"2504.07046","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.07046","snapshot_observed_at":"2026-08-05T10:59:25.603536Z","title":"A Unified Agentic Framework for Evaluating Conditional Image Generation","venue":"cs.CV","work_id":"85d289d1-967e-4c3e-9ac1-dc9dd32233af","year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.442343Z"},"links":{"cited_paper":"/paper/2504.07046","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:fa9609be92c9612c3c68fc149562aa57646a1485b1b0a0170d1c6e94b015c054","observation_id":"c5b1c0be-11ca-4d73-8f20-768a3ad58ce0","resolution":{"observed_at":"2026-08-05T10:59:25.608823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02381","last_updated":"2025-02-28T23:33:22Z","snapshot_observed_at":"2026-08-04T16:58:26.946941Z","submitted_at":"2024-10-03T11:01:25Z","title":"MetaMetrics: Calibrating Metrics For Generation Tasks Using Human Preferences","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02381","snapshot_observed_at":"2026-08-05T10:59:25.447712Z","title":"MetaMetrics: Calibrat- ing Metrics For Generation Tasks Using Human Preferences","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.447712Z"},"links":{"cited_paper":"/paper/2410.02381","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:81226589528d3618609776c12883055dfbf1dca0b99e703825ccdcef0581a25d","observation_id":"1222bc61-b6f9-43d4-8f9e-6dd8c40ffbe7","resolution":{"observed_at":"2026-08-05T10:59:25.447712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.048917Z","title":"Q-Align: Teaching LMMs for Vi- sual Scoring via Discrete Text-Defined Levels","venue":null,"work_id":"9f38885f-a3b1-4f17-ac46-5bc9b340163c","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.452535Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:68133784e9abc5aaaf5a8a6f3a39d079c2ca309da591f7dc6c35cf3f3bef89fb","observation_id":"c18b939d-e1e9-466f-9d84-46bb873e2f98","resolution":{"observed_at":"2026-08-05T10:59:26.054235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.033149Z","title":"Freeman, Fr ´edo Durand, and Song Han","venue":null,"work_id":"6dd462d8-1e91-46b8-8882-7a34eec8da5b","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.457998Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:2e5eda6470c085ca0353216917ccdeebcfef358110435e1895b060f8a662af2d","observation_id":"32f27f7a-ff86-4000-9462-b39e2de7764c","resolution":{"observed_at":"2026-08-05T10:59:26.038385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.016172Z","title":"Imagereward: learning and evaluating human preferences for text-to-image generation","venue":null,"work_id":"3eca138a-79d8-4746-aea3-5f36abcbdea4","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.462627Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:ac1c9c3ad46fea0a2f8b80609eebbc47022e03b8d338d4d50a3cc7fd79661515","observation_id":"68ba6e7e-0c1f-4ae1-b375-e9f30eeea7c7","resolution":{"observed_at":"2026-08-05T10:59:26.021759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:26.000012Z","title":"From image descriptions to visual denotations: New similarity metrics for semantic inference over event descrip- tions","venue":null,"work_id":"a6954fe6-1615-4f35-9b19-46d98afbc00e","year":2014},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.467230Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:f8205e7c6fc450bbada3b3e0a9a5691e872464cde2a1e6228e8726c664dcda61","observation_id":"ca2cf8e9-42a1-4087-bce4-6565c8c23a1b","resolution":{"observed_at":"2026-08-05T10:59:26.004937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15862","last_updated":"2025-01-16T06:07:12Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T14:38:59Z","title":"Do LLMs Really Think Step-by-step In Implicit Reasoning?","version":4},"cited_work":{"arxiv_id":"2411.15862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15862","snapshot_observed_at":"2026-08-05T10:59:25.563147Z","title":"Do LLMs Really Think Step-by-step In Implicit Reasoning?","venue":"cs.CL","work_id":"e78861dd-e1b4-45eb-a594-0e2e4f5bbb10","year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.472816Z"},"links":{"cited_paper":"/paper/2411.15862","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:03650420990aa1d30a56cec513620a61631eef1bf07342838a0e541be2f7e48d","observation_id":"17d3516d-a812-4564-bd2d-f200f0df8ee5","resolution":{"observed_at":"2026-08-05T10:59:25.569931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.982240Z","title":"Joint face detection and alignment using multitask cascaded convolutional networks","venue":null,"work_id":"027f3898-10e1-4064-9243-e0e7b1e0f88e","year":2016},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.477888Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:d5e7ca9a92ec4a4163359126d7e7202c7f49057993a2037e86bace32838fc279","observation_id":"0d823e10-f84d-48a0-8299-26cdc2588532","resolution":{"observed_at":"2026-08-05T10:59:25.988120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.964628Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","venue":null,"work_id":"fd41b594-6fbd-4c96-8bc8-98dff9806995","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.483107Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:0382a10b3e3902ca2b0e9dfa5b89afafa7bb0f969469cb99450627c81cebda64","observation_id":"d90bafaf-62e0-4b2f-9285-c79cece63472","resolution":{"observed_at":"2026-08-05T10:59:25.969848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.947528Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":null,"work_id":"af10b73b-8812-436e-972a-d5ca4cb79219","year":2023},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.487821Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:b1b589e6310d8386cb635050b6cc065ced2020b1c621db171d8031fab6e1be3b","observation_id":"0f7c9d09-bebb-4079-a423-a0da2835699a","resolution":{"observed_at":"2026-08-05T10:59:25.953113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16843","last_updated":"2024-11-19T02:52:45Z","snapshot_observed_at":"2026-08-06T19:03:44.030685Z","submitted_at":"2024-02-26T18:59:18Z","title":"Multi-LoRA Composition for Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16843","snapshot_observed_at":"2026-08-05T10:59:25.492941Z","title":"Multi-LoRA Composition for Image Genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.492941Z"},"links":{"cited_paper":"/paper/2402.16843","citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:9cf9bd819e7d50914a64e57c068a84a43453447d360b5ecbe0f80ac6f8c7583d","observation_id":"532727e3-fc14-42dd-b45b-baee8ae1076b","resolution":{"observed_at":"2026-08-05T10:59:25.492941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.930490Z","title":"Sim- ple multi-dataset detection","venue":null,"work_id":"7b5665e1-56a0-4747-9c3c-00810ed21b74","year":2022},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.497812Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:111b8a81fa2d9491aca7ba0b82c3b975b0b3becb96511a109aa6fc597b934d71","observation_id":"d7eece6c-bcff-4f61-b8b4-1e2d2d221c3e","resolution":{"observed_at":"2026-08-05T10:59:25.935618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.911871Z","title":"noisy, blurry, soft, deformed, ugly","venue":null,"work_id":"b92c8be7-78aa-451a-89c5-1da59bde35b6","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.503244Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:73caf7cbcbdd11846f4d2cf9a879dee4f135bd63c89c9537e176d82609821b00","observation_id":"d9f0ae3c-0f54-4adc-94ef-6deca4d71f5f","resolution":{"observed_at":"2026-08-05T10:59:25.918317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:59:25.895580Z","title":"<Text prompt>","venue":null,"work_id":"41456882-62f0-47b2-8227-4fc6a2e9e1fd","year":null},"citing_paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:59:25.508500Z"},"links":{"citing_paper":"/paper/2509.03385"},"observation_digest":"sha256:2e443ccb5a814209b12470e9552701602a2c053e6aa75fd80e3e508e1a6929b0","observation_id":"587e5dd6-79c2-44cb-8b2e-630b231e6ad6","resolution":{"observed_at":"2026-08-05T10:59:25.901110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03385","last_updated":"2025-09-03T15:02:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T10:59:22.778037Z","submitted_at":"2025-09-03T15:02:40Z","title":"Human Preference-Aligned Concept Customization Benchmark via Decomposed Evaluation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":3,"verified_fuzzy":46},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2509.03385."}