{"as_of":"2026-08-13T11:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5953604aa50fe6bc50f4c6d0aef0d3e48422743cb0adf8a30dd33da71570ad03","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:02:48.133087Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.01028/citation-record","integrity":"/paper/2509.01028/integrity","json":"/paper/2509.01028/citation-record.json","paper":"/paper/2509.01028"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:56.262394Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"94f02241-6e6f-4560-a089-b073dc454724","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:40.759028Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:64237c570a2e46e807ce4d05ed8d38791827f67199a58a1684cfd6ea13b3d0be","observation_id":"171cff55-d32b-4c43-b359-17ea12f56dba","resolution":{"observed_at":"2026-08-05T13:02:56.347916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:56.128119Z","title":"Spatext: Spatio-textual representation for con- trollable image generation","venue":null,"work_id":"ae0eed81-d1a1-40e9-a01d-0a407bcfa762","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:40.868291Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:a467cbd5facd546423402cc87968ac35e71d5d504eb72ca8aee555ab89f3ff00","observation_id":"dc0570cb-ad13-4dac-888c-3e4977d49c6e","resolution":{"observed_at":"2026-08-05T13:02:56.188945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T13:02:41.014213Z","title":"ediff-i: Text-to-image dif- fusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.014213Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:c1595b6d1898921c982b893f31cefd5ae07fea8096421615c7cee70135e41df9","observation_id":"3893f42b-8f57-47a7-8e03-eef69f1cb5b3","resolution":{"observed_at":"2026-08-05T13:02:41.014213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.956208Z","title":"Multidiffusion: Fusing diffusion paths for controlled image generation","venue":null,"work_id":"b6a406c5-efd5-4b66-860d-aebc02572941","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.095792Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:59389deb0cf48a1effc3c64d8dd7b4db24d4bcb4a20fb7bc99d0b2604e1b9729","observation_id":"4d900ede-3c64-49e3-bce8-3a40089e1b2a","resolution":{"observed_at":"2026-08-05T13:02:56.039945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.788308Z","title":"Masksketch: Unpaired structure-guided masked image generation","venue":null,"work_id":"10fd4af1-4b4e-4b69-9878-fc1f96e59eb6","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.179093Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:2b6f0c9ade44f68512f4bca058bbc12e84710bdee4422fc7b93df85d11133665","observation_id":"47eb6e94-8abb-4a49-b227-ff9d7cd930bd","resolution":{"observed_at":"2026-08-05T13:02:55.868254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.615113Z","title":"In- structpix2pix: Learning to follow image editing instructions","venue":null,"work_id":"50c53b61-ddff-4f56-aa92-54157c25eaab","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.238409Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:8a628c87c044ed449f7304fb7f4994f1c376dfb22ed99d05b6e13122d1f711dc","observation_id":"bec0c064-7098-40df-9c01-6c52f8c44e32","resolution":{"observed_at":"2026-08-05T13:02:55.697658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.444596Z","title":"Exploring the capability of text-to-image diffusion models with structural edge guidance for multi-spectral satellite image inpainting","venue":null,"work_id":"e2a38f0a-8198-4f2e-b0f2-6094cd31e251","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.322231Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:58d3c2632f560f07852c1b947a61bee9a720cd25319b46ff68763c3efa2026df","observation_id":"9947c29d-7657-442d-a4cd-1d1621e4f09c","resolution":{"observed_at":"2026-08-05T13:02:55.527197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.288525Z","title":"Diffusion mod- els beat gans on image synthesis","venue":null,"work_id":"5c34ac1b-06d2-4f1c-b888-45b8a73bf295","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.379040Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:d2f65f2f2b8d88036cf60c88b5f72460c4204964a5e282c06c120684442fb6b3","observation_id":"7253424e-4e60-417c-bde6-e4a0a45178b5","resolution":{"observed_at":"2026-08-05T13:02:55.348686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:55.153388Z","title":"Cogview2: Faster and better text-to-image generation via hi- erarchical transformers","venue":null,"work_id":"58488b8a-868b-487b-85dd-43ec62b8489c","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.468038Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:e2a8b8eea87f32f96482c867a8d32fab00e7c63a6cd168a9a9723e2d6953ad66","observation_id":"4ed4a36f-9019-47ca-ae01-06f49ca21a0a","resolution":{"observed_at":"2026-08-05T13:02:55.212720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.983316Z","title":"Diffusion self-guidance for control- lable image generation","venue":null,"work_id":"3bb49ce1-6ac8-4dc0-a012-31ee77442832","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.554667Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:a7d58df4919e17958d2663439d8cc425324999edd17812d2a0ff3cda3e5c5026","observation_id":"472db9ff-d4c7-4ec0-a856-77452c8138f1","resolution":{"observed_at":"2026-08-05T13:02:55.062002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04150","last_updated":"2025-01-04T07:44:49Z","snapshot_observed_at":"2026-08-12T23:18:36.205780Z","submitted_at":"2025-01-04T07:44:49Z","title":"Benchmarking Large and Small MLLMs","version":1},"cited_work":{"arxiv_id":"2501.04150","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.04150","snapshot_observed_at":"2026-08-05T13:02:48.304798Z","title":"Benchmarking Large and Small MLLMs","venue":"cs.CV","work_id":"91da5fa3-7632-4bcf-af61-b19f8314db43","year":2025},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.643036Z"},"links":{"cited_paper":"/paper/2501.04150","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:17942775a7c75d047e8a5e8a2f7b4a62381410df5636850a93fb9f1d1e76bb9e","observation_id":"fbfe6025-91e2-41f0-a5d1-834aa6be3914","resolution":{"observed_at":"2026-08-05T13:02:48.389342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.822022Z","title":"Promptmagician: Interactive prompt engineering for text-to-image creation","venue":null,"work_id":"a6842560-6151-413f-a82d-c119c57c620d","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.730833Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:cebb13d8fa352e6c65cffe2fd24a4454682183533dabed721a9e97879e6a0159","observation_id":"62438225-7a34-4b39-bd18-83b8c1bf66fd","resolution":{"observed_at":"2026-08-05T13:02:54.899921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.651047Z","title":"Make-a-scene: Scene- based text-to-image generation with human priors","venue":null,"work_id":"b97ef5db-e8e7-4f98-863a-6c22fbfc470f","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.818279Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:9fff6259dd471693554e3c40bdd6148733cda692961720297e86933cee224c63","observation_id":"ea622e84-384e-4810-b90e-6b020a4871e2","resolution":{"observed_at":"2026-08-05T13:02:54.735374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-05T13:02:41.908241Z","title":"An image is worth one word: Personalizing text-to- image generation using textual inversion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.908241Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:b292625ea20228a2f2afbd83a56f6959105ebef9da5f207ede6b166bc853b23d","observation_id":"f4f13115-606a-4aa1-910a-472c5cc7487e","resolution":{"observed_at":"2026-08-05T13:02:41.908241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12092","last_updated":"2023-11-27T08:29:54Z","snapshot_observed_at":"2026-08-13T05:21:00.604208Z","submitted_at":"2023-11-20T18:59:01Z","title":"Concept Sliders: LoRA Adaptors for Precise Control in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12092","snapshot_observed_at":"2026-08-05T13:02:41.996614Z","title":"Concept sliders: Lora adap- tors for precise control in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.996614Z"},"links":{"cited_paper":"/paper/2311.12092","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:fe8a6e334927a0068b7ca9f5675df9e95b03743b7765e9c6383957592ab02f35","observation_id":"46111ca1-1369-432b-908d-5ed05711c4aa","resolution":{"observed_at":"2026-08-05T13:02:41.996614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.492322Z","title":"Instructdiffusion: A generalist modeling inter- face for vision tasks","venue":null,"work_id":"e93f3ea8-b6f2-43f3-8a89-d8bc691525e6","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.101055Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:7560d95f3cd0f3db27bc6bb53cf9383b24e94061744e9e74a0f312bdbbcd4288","observation_id":"e2d9bc8e-a2dc-4548-b874-28d6d789e8eb","resolution":{"observed_at":"2026-08-05T13:02:54.569154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.320277Z","title":"Vec- tor quantized diffusion model for text-to-image synthesis","venue":null,"work_id":"9976316c-c139-41a1-8110-df4fc6449ac1","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.204527Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:0d51b2fb6222ec7e837c91fcc7e7e93f2d44eac93a6a122e4b71dac89330e338","observation_id":"ef434682-eb4f-43fb-bf84-a55632ee29c9","resolution":{"observed_at":"2026-08-05T13:02:54.402190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.156615Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"807e54ed-1801-4d43-ae22-224001be8646","year":2016},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.308627Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:ba960687768bea3c05c0d7503dbb0fc8047b19b6276de9b9361f56f4ec4046d3","observation_id":"945c0996-6748-43bd-9b70-15befcfab734","resolution":{"observed_at":"2026-08-05T13:02:54.235354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-05T13:02:42.377198Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.377198Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:5764a6dda5a96aeeab9c495456d3205b423477fac31392f7692895e3f5abb0cb","observation_id":"a13b6959-f022-48c2-84df-cea2093d1f20","resolution":{"observed_at":"2026-08-05T13:02:42.377198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-05T13:02:42.526578Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.526578Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:3789de0458d9054934f6f0ebc528125e1fedd4613d683431126d09623d04d6ea","observation_id":"361aed5f-5979-4a6c-acc8-7f7f504e81a1","resolution":{"observed_at":"2026-08-05T13:02:42.526578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:42.549098Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.549098Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:a4eb41bc2e399989b0c6cb788c75b0930ff928412d18371ea68f38dc06605236","observation_id":"de3798fe-2c36-459c-982b-a61344c33bd1","resolution":{"observed_at":"2026-08-05T13:02:42.549098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:54.008001Z","title":"To- wards quantitative evaluation metrics for image editing ap- proaches","venue":null,"work_id":"c2d75e84-c27b-4d73-8607-7ee65681bbeb","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.713246Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:8bfeeddf77e34933a1778d6fb7abd4995516e0302b5199d8c3b0a9de8663c11d","observation_id":"3846404e-86cb-4f60-aef4-e120c3714a79","resolution":{"observed_at":"2026-08-05T13:02:54.069115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09778","last_updated":"2023-02-22T02:14:55Z","snapshot_observed_at":"2026-08-10T14:56:32.992285Z","submitted_at":"2023-02-20T05:48:41Z","title":"Composer: Creative and Controllable Image Synthesis with Composable Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09778","snapshot_observed_at":"2026-08-05T13:02:42.879278Z","title":"Composer: Creative and controllable im- age synthesis with composable conditions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:42.879278Z"},"links":{"cited_paper":"/paper/2302.09778","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:f6f5af1ffd0ac72f8651b3509e147493a4cbdd21f4556b98e333593ac3e082ae","observation_id":"3b3853b4-260b-4935-8adb-435db38e46d0","resolution":{"observed_at":"2026-08-05T13:02:42.879278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11797","last_updated":"2023-02-23T06:20:29Z","snapshot_observed_at":"2026-07-31T05:45:38.757248Z","submitted_at":"2023-02-23T06:20:29Z","title":"Region-Aware Diffusion for Zero-shot Text-driven Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11797","snapshot_observed_at":"2026-08-05T13:02:43.090964Z","title":"Region-aware diffusion for zero-shot text-driven image editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.090964Z"},"links":{"cited_paper":"/paper/2302.11797","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:f8e26ddf9361df5e2ead797d3b171be0f95b2329a0b1ae6c8a454969ca1475f4","observation_id":"2bce49ae-08d7-4958-8d3a-c749fb2d134e","resolution":{"observed_at":"2026-08-05T13:02:43.090964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:53.804515Z","title":"Pfb-diff: Progres- sive feature blending diffusion for text-driven image editing","venue":null,"work_id":"92be4c4a-4dac-41d4-85b3-7d7088099b79","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.261731Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:5b4bd4d2e57785c725452702bde69dec38074315e6e9a170b7fe82dde83a8d0b","observation_id":"63e909ea-540a-44ad-b635-ee7a7af59788","resolution":{"observed_at":"2026-08-05T13:02:53.891036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:53.647147Z","title":"Imagic: Text-based real image editing with diffusion models","venue":null,"work_id":"7b87ea09-1d24-4cf9-a924-85b9fefd07fe","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.422673Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:2b1758cab11b0cb1f4adc24293f51d932ea2e0dd9ad2b03f2c17d9e2401cdb7c","observation_id":"361e9a2c-7bf1-4ddf-8f56-fda871f24118","resolution":{"observed_at":"2026-08-05T13:02:53.714650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:53.453866Z","title":"Diffusion-lm improves control- lable text generation","venue":null,"work_id":"93d0c1fb-ec6f-41ce-83dc-ec7b2dfc3f3f","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.590348Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:48186e929d4defeb0b73c9dea90c5d4691ee23e98258b2a6c1aae0a759296584","observation_id":"2f686fe7-9c29-4f5f-a55a-29b1b33bd7bc","resolution":{"observed_at":"2026-08-05T13:02:53.555428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:53.268861Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":"b5871f74-a4f0-4f4f-81d5-9f8b267a6704","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.765241Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:bea8464119eaee71111ab6bba511d0cd67895e7b55a8fbfe472eb8d279539528","observation_id":"56518438-a3fe-4087-a3fc-4e8a40c1a743","resolution":{"observed_at":"2026-08-05T13:02:53.358906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:53.081166Z","title":"Stylet2i: Toward compositional and high-fidelity text- to-image synthesis","venue":null,"work_id":"36763f0f-09f3-4942-9651-c6e8b8d735a0","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:43.943201Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:413d48dc56de554564ffae6a1e5f5047961eb1a0db2d568f0b5a1c953e4d5115","observation_id":"eb9e0650-51be-46d7-b6e8-1cf9dbfaf56e","resolution":{"observed_at":"2026-08-05T13:02:53.170987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.887764Z","title":"Design guidelines for prompt engineering text-to-image generative models","venue":null,"work_id":"c8517af9-ab0b-4b1d-9cbc-17a90b92e1c8","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.120865Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:3b03fa45cdeb276036ea971c426b2f78a981e73c6a1687b001b637fe7fc065cd","observation_id":"f1f05119-4db5-413e-bd6d-80fc55529117","resolution":{"observed_at":"2026-08-05T13:02:52.975834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.735448Z","title":"Evalcrafter: Benchmarking and evalu- ating large video generation models","venue":null,"work_id":"5a1f760b-5dc8-4d5e-852f-2f480020cd94","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.282623Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:e180da68184a0988165bfa7030989bf05401569f102dafccea13ea0440114b20","observation_id":"1ff23674-0941-4423-bbef-6bbe32ab0d5f","resolution":{"observed_at":"2026-08-05T13:02:52.805326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.580508Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":"45fb869a-173a-447f-8ae3-6fa211290186","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.456053Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:480b2f284ffa529b1b9798a4634132e55a3752c4e973d7edfe02c90b80031bef","observation_id":"7fd2dc89-906d-4e9e-9747-5160add0bd7b","resolution":{"observed_at":"2026-08-05T13:02:52.655940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-08T06:35:17.078531Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-05T13:02:44.632111Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equa- tions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.632111Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:acec7cf61e6e138e222b62e79d70972d59cbe9793135ce1777e0dad1a52aa163","observation_id":"3ae325de-9ac8-4ce5-bf5e-ad3fb234dec9","resolution":{"observed_at":"2026-08-05T13:02:44.632111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.425052Z","title":"T2i-adapter: Learning adapters to dig out more controllable ability for text-to-image diffusion models","venue":null,"work_id":"b1c12007-e98b-47f5-978e-edd01fd74a9b","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.811254Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:ae749103c07e8a74543ee47d0f9ea557f7d9ec7e953c96a1c6c0d43a3aa6a9a9","observation_id":"76ea0538-216a-4850-80c7-901198e7d91d","resolution":{"observed_at":"2026-08-05T13:02:52.498864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-05T13:02:44.994684Z","title":"Glide: Towards photorealistic image generation and editing with text-guided diffusion models.arXiv preprint arXiv:2112.10741, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:44.994684Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:65b1214b4db723a55e8edf69e67b01e3bd0a69cf3fe30a83085105c1c0ad0297","observation_id":"8940d9a0-0edd-4e82-8379-d3226f0428b2","resolution":{"observed_at":"2026-08-05T13:02:44.994684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.271187Z","title":"Gpt-4o: Multimodal large language model by ope- nai","venue":null,"work_id":"89ced1fe-5c25-4eeb-b76e-2fc5dcb1d4f2","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.151216Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:474bf8814067a0cd848cd5bdc3fb2946a6b441149234279b3658abe3800325a7","observation_id":"30d41c25-8c0d-4356-87fb-90c49ad11cb5","resolution":{"observed_at":"2026-08-05T13:02:52.345736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:52.089083Z","title":"Zero-shot image-to-image translation","venue":null,"work_id":"b17acaec-1013-445e-91a3-b0cdc55d9507","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.315956Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:3670b2fce7cf2533a1c7e6f67e51eef431fd43617a5f992cca4e758c78a88be5","observation_id":"e432eebd-3fa9-40e3-b07f-3fdfdf83bd47","resolution":{"observed_at":"2026-08-05T13:02:52.185584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.936090Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"94baf53c-41f4-4324-9f8a-fefc65478d11","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.474613Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:3767aab40788e4c34db4726e8d551ada3b223b7536cff9ee38418f4db7736b7d","observation_id":"6f97ba68-fa76-494b-a24d-ce5a4d7797c9","resolution":{"observed_at":"2026-08-05T13:02:52.010202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-05T13:02:45.594697Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.594697Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:b1a77d7927b61e8d2f679c0e4b569b8a69adaec42d9ab940631677fbf96d405b","observation_id":"1f1b2ed7-2be4-4f31-af33-065e4701ba7f","resolution":{"observed_at":"2026-08-05T13:02:45.594697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.782767Z","title":"Diffusion autoen- coders: Toward a meaningful and decodable representation","venue":null,"work_id":"7cde989b-f79e-447c-8c3b-4dc2905d624f","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.776035Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:5bbc51f36d062664f3e9466d57a68cfb28c0fa5a912c30cd704e04bd813f1a2b","observation_id":"a95c1114-0ec7-469e-b42a-bc9957af4d0a","resolution":{"observed_at":"2026-08-05T13:02:51.856035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.629049Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":"306c5eea-9e13-4e97-86ea-4c64983e9193","year":2021},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:45.934721Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:b024882fd51ee1c4f0e4fe1e0ff6c427990a6aec9199bf9738548dbbe3c89c66","observation_id":"2310d6ea-5a77-4917-bf9d-7598d17673c7","resolution":{"observed_at":"2026-08-05T13:02:51.703543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.494122Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"31bceab9-64f0-4016-9129-cd14121cf28e","year":2020},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.045964Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:7375d3f198819a41e7ab266f4e3fcf735923eed0f1f317fe3f3fd77573cf3bd1","observation_id":"15573e66-8e4e-4b14-a3cb-fe56557cd031","resolution":{"observed_at":"2026-08-05T13:02:51.550582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T13:02:46.117188Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.117188Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:c4a1655f80a4aee8b6fa1705475c23e30964e49dfa0195143bfbd45ea283a76f","observation_id":"354610f3-1bc7-4456-aee7-e68c864ede0f","resolution":{"observed_at":"2026-08-05T13:02:46.117188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.328738Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"38ae7748-4ca3-45fc-aef6-9636921d9bfa","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.202236Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:c22463cd8b0fb6db0a03e74f8a2c9bb8bf38f1e765fb80fbaed470ac4c392bd2","observation_id":"9b019df2-1c40-4e9f-b6d1-649317b0ddde","resolution":{"observed_at":"2026-08-05T13:02:51.418186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.188206Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"127f3c05-26e2-4a5f-8673-20b72182861c","year":2015},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.330385Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:23e544d57d30dda8206a440b8becdfeb480ef067defd1a664fc9b25060ace2cf","observation_id":"41a4b1b1-5804-41fd-8f8a-5ec4a76db2de","resolution":{"observed_at":"2026-08-05T13:02:51.256493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:51.057335Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"000b2755-d8b1-4b3c-a7d2-f1946e3b8df7","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.438025Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:6fc1429dd63123efb34912dec775e944ee06a2a8e74e765d3b9798e21c344f73","observation_id":"ece99d1c-fdc8-4f49-b29c-9054c02d7fe5","resolution":{"observed_at":"2026-08-05T13:02:51.116969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.918748Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"7da25b90-a0dc-42f0-a5b6-411617f22563","year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.510622Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:b835a7be9e93698d9db03342134496760ebfed949c3e52266353378ad11574e8","observation_id":"9cdc0e8a-0fee-4bf6-b5be-4b119da898b9","resolution":{"observed_at":"2026-08-05T13:02:50.981736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.763354Z","title":"Hyperextended light- face: A facial attribute analysis framework","venue":null,"work_id":"f35d2a1e-2ae6-4dc9-8c98-0447cba3cfc0","year":2021},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.620251Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:394a14bb4a7141232e3a9393e3de456150f81f88532d032a4f6308e2645beff6","observation_id":"cce8261a-eb21-4b64-b157-0b9f22a1efdb","resolution":{"observed_at":"2026-08-05T13:02:50.836717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.693350Z","title":"Interfacegan: Interpreting the disentangled face representa- tion learned by gans","venue":null,"work_id":"d992d1a3-ab85-4b26-9146-74641133a6ee","year":2004},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.697430Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:ad580a8786ff09ee3a3949a2cb0936f50a0328ab963cef651bfd8e85814accc2","observation_id":"b8259f01-b5a1-4103-976b-d2d471949dfb","resolution":{"observed_at":"2026-08-05T13:02:50.711763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.541982Z","title":"Exploring compositional visual generation with latent classifier guidance","venue":null,"work_id":"6ddb0fd4-5a46-4b4d-a3ca-32aaef328d33","year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.782804Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:e64d723e619bb0b54d3975684ca179083ff2f6e3058b558539890713aa91ebb6","observation_id":"1a050c60-23ef-404d-9aee-63a95be71cd2","resolution":{"observed_at":"2026-08-05T13:02:50.615598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.388394Z","title":"Dragdiffusion: Harnessing diffusion models for interactive point-based image editing","venue":null,"work_id":"2ec657dd-471b-4fd6-92de-98f7a3729a32","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.843614Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:ccb36211cff43f4364c038deb8b4832a4207a8218505ad1edf73e1c833f33f61","observation_id":"9ab419ab-b7f9-4c54-aa98-93a5ba6cf4ec","resolution":{"observed_at":"2026-08-05T13:02:50.461127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16535","last_updated":"2024-09-25T01:02:30Z","snapshot_observed_at":"2026-08-13T09:34:33.656115Z","submitted_at":"2024-09-25T01:02:30Z","title":"Prompt Sliders for Fine-Grained Control, Editing and Erasing of Concepts in Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16535","snapshot_observed_at":"2026-08-05T13:02:46.913420Z","title":"Prompt sliders for fine-grained control, editing and erasing of concepts in dif- fusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.913420Z"},"links":{"cited_paper":"/paper/2409.16535","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:ea5f837e8be887d3617d8394e726134ebbb5662f9aa7e31e944e2b07cff81607","observation_id":"bceb3378-ed6f-41b8-a213-960e8d26ac01","resolution":{"observed_at":"2026-08-05T13:02:46.913420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:46.992195Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":null,"year":1921},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:46.992195Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:06fa10d4c037a326e8ac652df358492bd8e04b106c37ebdacce0195f7a009934","observation_id":"5c73c63e-9d68-4702-a424-b1b89ea00263","resolution":{"observed_at":"2026-08-05T13:02:46.992195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:47.070224Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.070224Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:c31d30f6ce52756fb60552247beb2de915e6e507a6490e370b58664c02026d28","observation_id":"6ee28df6-441d-48c1-8b94-cc59bda19a43","resolution":{"observed_at":"2026-08-05T13:02:47.070224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:50.207198Z","title":"Hive: Harnessing human feedback for instructional visual editing","venue":null,"work_id":"6f465386-eb75-45a9-8af2-ba279fced9b8","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.150970Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:80cd217e0404819c535049fac520b3888f0674f7b0ce0811996866115391df61","observation_id":"a641f85c-c1fc-4963-99bc-48309020b00b","resolution":{"observed_at":"2026-08-05T13:02:50.274580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.999820Z","title":"Open-sora: Democratizing efficient video production for all, 2024","venue":null,"work_id":"64b333ba-8c63-4bb2-bee1-8592647edb01","year":2024},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.253816Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:e70528b136bc9ba1bf3173ce31430cbe4afd0ffec5f1c8e9567a325f3f29264c","observation_id":"ab82282c-749f-4d44-96d1-f285c0f2fa6e","resolution":{"observed_at":"2026-08-05T13:02:50.103843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04632","last_updated":"2023-06-07T17:56:02Z","snapshot_observed_at":"2026-08-13T11:22:24.551370Z","submitted_at":"2023-06-07T17:56:02Z","title":"Designing a Better Asymmetric VQGAN for StableDiffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04632","snapshot_observed_at":"2026-08-05T13:02:47.333611Z","title":"Designing a better asymmetric vqgan for stablediffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.333611Z"},"links":{"cited_paper":"/paper/2306.04632","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:697d6ba47633caee3f94738f489c53ae9dde817eaeca472149aacc89db45339b","observation_id":"915da6b0-bfdb-48ef-b9fa-0f895980f630","resolution":{"observed_at":"2026-08-05T13:02:47.333611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.798526Z","title":null,"venue":null,"work_id":"a522b762-2c63-4441-aafe-89ea8cecf2ba","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.447867Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:b03c06a6449d81de3fef49db1d9400c30e742ddf9ebfd230372b4047804fd4c6","observation_id":"9e380240-1b64-4575-8a0f-0b001c742f36","resolution":{"observed_at":"2026-08-05T13:02:49.891582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.619803Z","title":"Age”, “Smile","venue":null,"work_id":"c10bc4aa-144f-4b8c-b46d-12938d25ad3a","year":2048},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.529939Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:d68d4f600b3be8221b488a66bdeb75748f081e912f50c47381d2db280446daa3","observation_id":"8507684c-e7e8-4fdb-8bb8-1606840e7be4","resolution":{"observed_at":"2026-08-05T13:02:49.722793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.448407Z","title":"When multiple subjects share the same attribute, our method lacks precise target selection, as it applies attribute changes uniformly across all subjects","venue":null,"work_id":"4019da7d-88b1-462e-8146-e2c4c904cd62","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.643477Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:439e5dc224197e05e97b5eff743ee8374527aab61a6d5ba2efcec8cf85fe7a67","observation_id":"73b93d65-1fc2-46c0-a8e8-a77a50fd602a","resolution":{"observed_at":"2026-08-05T13:02:49.549746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.245774Z","title":"Ablation Study on the threshold in our structure Loss","venue":null,"work_id":"96afde10-f56a-4a02-975f-6933c218b180","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.755503Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:6d53c8b15b21539f5c412a1d00262bf08987a4cecd73884ef772386120a49ded","observation_id":"a8eff5f8-faae-4f9f-9801-d5ffc47a5252","resolution":{"observed_at":"2026-08-05T13:02:49.345839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:49.077875Z","title":"Our method successfully controls the specified attribute consis- tently across frames, demonstrating its ability to generalize beyond static images","venue":null,"work_id":"ad9dc783-479f-4508-a3be-c64ef6f11959","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.830619Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:8b7cb8d1b4e25a8ce48fdf08e31a1257ad9b177b3b76de233fbca345da1c5e54","observation_id":"58dba2db-6b1e-4650-befb-860bf8ea7337","resolution":{"observed_at":"2026-08-05T13:02:49.170280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:48.866110Z","title":"Applying our image slider conditional priors to a video generation model maintains effective control and identity","venue":null,"work_id":"c8c254ad-e914-4953-aed4-c2fb8c164724","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:47.926897Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:24bf8afc312ca92912ca55f171b087c99f123029cfe7aadc44e5c0fedf4c6666","observation_id":"572ed1ef-04df-4502-9976-1af4d688b64e","resolution":{"observed_at":"2026-08-05T13:02:48.968773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:48.696074Z","title":"vector style","venue":null,"work_id":"27ae5cfc-e399-405a-9e1d-bb3d7c94be9f","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:48.029632Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:82555a7500a49b7f57a0021f7f92d69f721568cc7c247eb3eb0343e543edd1d6","observation_id":"b0cefd9b-17d0-4968-97fd-e0bbc5e7ee30","resolution":{"observed_at":"2026-08-05T13:02:48.793067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:02:48.479516Z","title":"Red Hair","venue":null,"work_id":"0e695b53-08a8-4140-a3b2-76e091991a65","year":null},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:48.133087Z"},"links":{"citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:e0ecccee5dc59055f0d0f8c6142c04ecc077be4ab91874442de33bf4fa2616cf","observation_id":"6c59f5f1-79b3-4e02-8f2b-777d29b8406c","resolution":{"observed_at":"2026-08-05T13:02:48.556512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T10:39:46.980467Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2509.01028."}