{"as_of":"2026-08-16T07:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7721ba5d62b6851cf9bef2b3389675aeda0573ec3580f841167298e3125f23f6","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:21:50.615568Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.10800/citation-record","integrity":"/paper/2411.10800/integrity","json":"/paper/2411.10800/citation-record.json","paper":"/paper/2411.10800"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2302.07121","last_updated":"2023-02-14T15:30:44Z","snapshot_observed_at":"2026-08-13T18:22:46.624746Z","submitted_at":"2023-02-14T15:30:44Z","title":"Universal Guidance for Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07121","snapshot_observed_at":"2026-08-12T19:21:50.207500Z","title":"arXiv:2302.07121","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.207500Z"},"links":{"cited_paper":"/paper/2302.07121","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:4729e8248a4295c357196b27ec3a005f7f7dc92354e700d933033b7053e5e89a","observation_id":"d59c934a-0038-44a7-83d1-7b81e0ce57a5","resolution":{"observed_at":"2026-08-12T19:21:50.207500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09800","last_updated":"2023-01-18T17:31:52Z","snapshot_observed_at":"2026-08-13T13:40:09.134144Z","submitted_at":"2022-11-17T18:58:43Z","title":"InstructPix2Pix: Learning to Follow Image Editing Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09800","snapshot_observed_at":"2026-08-12T19:21:50.216713Z","title":"arXiv:2211.09800","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.216713Z"},"links":{"cited_paper":"/paper/2211.09800","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:94af327acde32beec18bcd23a278252d8b43d87910593fc8dc2c9ffe72ff56f7","observation_id":"87a08015-fa52-4bcc-b0d4-e156fc1b40b2","resolution":{"observed_at":"2026-08-12T19:21:50.216713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08465","last_updated":"2023-04-17T17:42:19Z","snapshot_observed_at":"2026-08-15T13:56:13.732513Z","submitted_at":"2023-04-17T17:42:19Z","title":"MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08465","snapshot_observed_at":"2026-08-12T19:21:50.224125Z","title":"arXiv:2304.08465","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.224125Z"},"links":{"cited_paper":"/paper/2304.08465","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:f41edc7961cc6f49579a1b193e130703f55826d967ec0977a36259183ee3d137","observation_id":"09dd6f0b-5094-4bbb-8383-b47006f8ff38","resolution":{"observed_at":"2026-08-12T19:21:50.224125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13131","last_updated":"2022-03-24T15:44:50Z","snapshot_observed_at":"2026-08-13T16:15:54.920385Z","submitted_at":"2022-03-24T15:44:50Z","title":"Make-A-Scene: Scene-Based Text-to-Image Generation with Human Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13131","snapshot_observed_at":"2026-08-12T19:21:50.257271Z","title":"arXiv:2203.13131","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.257271Z"},"links":{"cited_paper":"/paper/2203.13131","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:e88de6c8c5af31cb450bb6d756ad1bcd4dee98b3488b0ae3a9384552d8e23ec1","observation_id":"8b6c1793-7cd5-4eb8-b36a-6fe66e2bf8b0","resolution":{"observed_at":"2026-08-12T19:21:50.257271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-12T19:21:50.272654Z","title":"arXiv:2208.01618","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.272654Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:48ff854a3e2f122f8089e204906f5536e969719f77d4a6a78ff83193b618b890","observation_id":"803fb587-7f38-4ced-928b-89449090127c","resolution":{"observed_at":"2026-08-12T19:21:50.272654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-12T19:21:50.281529Z","title":"arXiv:2208.01626","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.281529Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:9477513fda81475b22ee886e46fe914a2c3f0bfca0b5ce1a731987fab8e513ba","observation_id":"4be13321-0715-4680-a00a-d7b4890e7919","resolution":{"observed_at":"2026-08-12T19:21:50.281529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-08-15T09:45:11.146308Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-08-12T19:21:50.317683Z","title":"arXiv:2210.09276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.317683Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:854701ea90b29d9ecf3991af4121cc483911ac1392af75454bdaebf3309b8e18","observation_id":"a4bfc2b0-ae4c-4d4e-8a1f-c66b6f855572","resolution":{"observed_at":"2026-08-12T19:21:50.317683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02711","last_updated":"2022-08-11T13:36:19Z","snapshot_observed_at":"2026-08-15T23:20:27.644569Z","submitted_at":"2021-10-06T12:59:39Z","title":"DiffusionCLIP: Text-Guided Diffusion Models for Robust Image Manipulation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02711","snapshot_observed_at":"2026-08-12T19:21:50.338867Z","title":"arXiv:2110.02711","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.338867Z"},"links":{"cited_paper":"/paper/2110.02711","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:a3395bc96d195c20edad3ea8ef4f92cd8d794a76ffcae02ad6735bbf209a1ec3","observation_id":"df74b9bc-f278-4c25-8ee2-3482c75b9cb2","resolution":{"observed_at":"2026-08-12T19:21:50.338867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-14T03:40:56.071989Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-12T19:21:50.365014Z","title":"arXiv:2108.01073","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.365014Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:d255844eef55957c60fe4b43d4f4280430057ac35e6d90f7b2be3a77a5e41c0b","observation_id":"4cfafba1-5bc8-411b-96d9-5476cef0372b","resolution":{"observed_at":"2026-08-12T19:21:50.365014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-08-13T05:43:28.614772Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.08453","snapshot_observed_at":"2026-08-12T19:21:50.371854Z","title":"arXiv:2302.08453","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.371854Z"},"links":{"cited_paper":"/paper/2302.08453","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:e1928fb6cd41f65dc8270dcceea60c2bf416c131dced17a132de42fda5fdc979","observation_id":"d9c4baa8-e8bf-45e5-b0de-4122de8852d7","resolution":{"observed_at":"2026-08-12T19:21:50.371854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10741","last_updated":"2022-03-08T18:18:49Z","snapshot_observed_at":"2026-08-07T12:21:17.790675Z","submitted_at":"2021-12-20T18:42:55Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text-Guided Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10741","snapshot_observed_at":"2026-08-12T19:21:50.381798Z","title":"arXiv preprint arXiv:2112.10741","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.381798Z"},"links":{"cited_paper":"/paper/2112.10741","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:7335e89b6e1c605aa6b90ff0a1093c9d7dc10926972cbe036473dd4516ba98e2","observation_id":"8094e049-6e1b-4663-af06-4433f2141386","resolution":{"observed_at":"2026-08-12T19:21:50.381798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03027","last_updated":"2023-02-06T18:59:51Z","snapshot_observed_at":"2026-08-13T12:49:57.770736Z","submitted_at":"2023-02-06T18:59:51Z","title":"Zero-shot Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03027","snapshot_observed_at":"2026-08-12T19:21:50.402558Z","title":"arXiv:2302.03027","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.402558Z"},"links":{"cited_paper":"/paper/2302.03027","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:8cfd15630be54a5fd8ac3a8064d956bc6096d328ebe83ed89cff0ab321a1e76f","observation_id":"c08fe681-b04d-4863-9e6c-46d3c5565e83","resolution":{"observed_at":"2026-08-12T19:21:50.402558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T19:21:50.428079Z","title":"arXiv:2103.00020","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.428079Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:dfca26ed782156e6cb35bbeecaa8a93ab1f3eed522e8e8eb37fd4900762ccfcc","observation_id":"84ebe27e-feeb-422e-b15e-c755052655d8","resolution":{"observed_at":"2026-08-12T19:21:50.428079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T19:21:50.450081Z","title":"arXiv:2204.06125","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.450081Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:fb0c9f2b8829d02edf44ba47c5c010fde6d18349ec55853a997cad010bed8f32","observation_id":"a8a2d776-07b0-4ab7-b494-b36ab9f93770","resolution":{"observed_at":"2026-08-12T19:21:50.450081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-08-12T12:48:35.419134Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-12T19:21:50.462354Z","title":"arXiv:2205.11487","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.462354Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:beb28aa0dd8f4bc7b2cb56ea62f07533f5da655a448fb12bbd0e5f3c02daf9f9","observation_id":"c861c9e6-0906-4b06-bc93-6b6742e767a6","resolution":{"observed_at":"2026-08-12T19:21:50.462354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-12T19:21:50.474158Z","title":"arXiv:1503.03585","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.474158Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:ef70d6ec6b732d1c84d03b76e844dd7b948f11ed35a1e3b7d1e216ecb7c64357","observation_id":"e8484a97-79b2-4d06-8a6a-f9f6239e2da4","resolution":{"observed_at":"2026-08-12T19:21:50.474158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08005","last_updated":"2022-06-16T00:01:39Z","snapshot_observed_at":"2026-08-13T17:34:10.940024Z","submitted_at":"2021-11-15T05:41:12Z","title":"Solving Inverse Problems in Medical Imaging with Score-Based Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08005","snapshot_observed_at":"2026-08-12T19:21:50.512945Z","title":"arXiv:2111.08005","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.512945Z"},"links":{"cited_paper":"/paper/2111.08005","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:2d3d90e554a00950d8153a898d5b35078f5d8c15228a1c7a44db6987be30387e","observation_id":"34dfcad9-87ff-4dab-97c2-5f382898c276","resolution":{"observed_at":"2026-08-12T19:21:50.512945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-12T19:21:50.527571Z","title":"arXiv:2011.13456","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.527571Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:9b4afdbc4e9f571a317c6cdb8ad9beb8cb21ebe1ee4c1c1552e45dccb4b5a40d","observation_id":"a3c931f3-6942-4f95-b141-dc51d315d42a","resolution":{"observed_at":"2026-08-12T19:21:50.527571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02698","last_updated":"2025-01-22T22:16:18Z","snapshot_observed_at":"2026-08-13T11:01:55.318763Z","submitted_at":"2023-07-06T00:07:32Z","title":"Dequantization and Color Transfer with Diffusion Models","version":5},"cited_work":{"arxiv_id":"2307.02698","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.02698","snapshot_observed_at":"2026-08-12T19:21:50.952065Z","title":"Dequantization and Color Transfer with Diffusion Models","venue":"cs.CV","work_id":"af70ff65-9c0b-4518-b42c-6dcfe584a00a","year":2023},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.538261Z"},"links":{"cited_paper":"/paper/2307.02698","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:95d661ccc52daabe1ee16eeb16e29fdef4719963169de0a212e9dffd6ef0af04","observation_id":"b47fa4b4-81cd-4607-b142-e56fdbe2fd3a","resolution":{"observed_at":"2026-08-12T19:21:50.968361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12952","last_updated":"2022-05-25T17:58:26Z","snapshot_observed_at":"2026-08-14T06:13:43.725116Z","submitted_at":"2022-05-25T17:58:26Z","title":"Pretraining is All You Need for Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12952","snapshot_observed_at":"2026-08-12T19:21:50.545989Z","title":"arXiv preprint arXiv:2205.12952","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.545989Z"},"links":{"cited_paper":"/paper/2205.12952","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:e99fb97e158119eeb8a9b46d5a089e5fe19d27a76ae6eedf88c1b610ec817b94","observation_id":"ca093982-a4a8-48b4-9205-9c5b1345e96e","resolution":{"observed_at":"2026-08-12T19:21:50.545989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05703","last_updated":"2021-12-22T02:51:29Z","snapshot_observed_at":"2026-08-13T19:41:05.067882Z","submitted_at":"2021-04-12T17:58:46Z","title":"Adversarial Open Domain Adaptation for Sketch-to-Photo Synthesis","version":2},"cited_work":{"arxiv_id":"2104.05703","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.05703","snapshot_observed_at":"2026-08-12T19:21:50.848166Z","title":"Adversarial Open Domain Adaptation for Sketch-to-Photo Synthesis","venue":"cs.CV","work_id":"20e3b247-aa91-4e17-9417-5e47e6b71d61","year":2021},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.554741Z"},"links":{"cited_paper":"/paper/2104.05703","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:8685d283670c37984d81538d85e48e140b812ccde5478862aa8664bcb7a0ccdc","observation_id":"446c94bd-6845-4381-9b98-1e794364efee","resolution":{"observed_at":"2026-08-12T19:21:50.857165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09833","last_updated":"2023-03-17T08:38:33Z","snapshot_observed_at":"2026-08-13T12:22:50.689322Z","submitted_at":"2023-03-17T08:38:33Z","title":"FreeDoM: Training-Free Energy-Guided Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09833","snapshot_observed_at":"2026-08-12T19:21:50.561084Z","title":"arXiv:2303.09833","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.561084Z"},"links":{"cited_paper":"/paper/2303.09833","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:d0db4ad153e4c04a196f1e7ee57e4aa4719956dec46e377c7a1a472fea51df81","observation_id":"e0bfa1cd-2a7a-4039-bfe5-bc336627c4f6","resolution":{"observed_at":"2026-08-12T19:21:50.561084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16225","last_updated":"2023-12-07T07:56:52Z","snapshot_observed_at":"2026-08-13T11:33:14.689759Z","submitted_at":"2023-05-25T16:32:01Z","title":"ProSpect: Prompt Spectrum for Attribute-Aware Personalization of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16225","snapshot_observed_at":"2026-08-12T19:21:50.590167Z","title":"arXiv:2305.16225","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.590167Z"},"links":{"cited_paper":"/paper/2305.16225","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:f8ed5ce5b1f6582ba993ae2fcbee3bee49b8d62c90aa67856ba6a226cadc7d06","observation_id":"17ea2ea7-b44f-4c2a-99fe-b26d6cfd4ed6","resolution":{"observed_at":"2026-08-12T19:21:50.590167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03126","last_updated":"2017-03-06T22:52:53Z","snapshot_observed_at":"2026-08-14T21:40:26.082374Z","submitted_at":"2016-09-11T07:11:13Z","title":"Energy-based Generative Adversarial Network","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03126","snapshot_observed_at":"2026-08-12T19:21:50.602169Z","title":"arXiv:1609.03126","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.602169Z"},"links":{"cited_paper":"/paper/1609.03126","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:311b7316d2cf8554d25da9f6436ea2b9e7e5d23b071468813b870b775f4d554c","observation_id":"328c3289-2eab-43ac-8557-75719b835199","resolution":{"observed_at":"2026-08-12T19:21:50.602169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16322","last_updated":"2023-10-29T15:59:24Z","snapshot_observed_at":"2026-08-13T11:33:07.365487Z","submitted_at":"2023-05-25T17:59:58Z","title":"Uni-ControlNet: All-in-One Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16322","snapshot_observed_at":"2026-08-12T19:21:50.615568Z","title":"arXiv:2305.16322","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.615568Z"},"links":{"cited_paper":"/paper/2305.16322","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:2cfda98fb442829d530ece67cb833e97e159262cc6adabe3dbf316020aad9ad7","observation_id":"17dbe4c4-e971-4d88-9c59-bed3599cdb4d","resolution":{"observed_at":"2026-08-12T19:21:50.615568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-12T19:21:50.351966Z","title":"arXiv:1405.0312","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.351966Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:2ea4c0101572a33f9800bc2e87a98f6ba86f2402ece3de65e78ee4b0dd385522","observation_id":"6fa2507b-5da8-4439-b277-f948981f4efa","resolution":{"observed_at":"2026-08-12T19:21:50.351966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06434","last_updated":"2016-01-07T23:09:39Z","snapshot_observed_at":"2026-08-12T18:43:14.431633Z","submitted_at":"2015-11-19T22:50:32Z","title":"Unsupervised Representation Learning with Deep Convolutional Generative Adversarial Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06434","snapshot_observed_at":"2026-08-12T19:21:50.439416Z","title":"arXiv:1511.06434","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.439416Z"},"links":{"cited_paper":"/paper/1511.06434","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:94ea596014ec3e53b072274562036dc4b77fe50d820edc7132d416fe480e9a94","observation_id":"d32a52cd-0cfd-4db3-926d-7989793f08e8","resolution":{"observed_at":"2026-08-12T19:21:50.439416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.04357","last_updated":"2017-04-12T15:04:01Z","snapshot_observed_at":"2026-08-14T21:25:39.798867Z","submitted_at":"2016-12-13T20:48:58Z","title":"Stacked Generative Adversarial Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1612.04357","snapshot_observed_at":"2026-08-12T19:21:50.289428Z","title":"arXiv:1612.04357","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.289428Z"},"links":{"cited_paper":"/paper/1612.04357","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:fe7ab79dd39f6515a43cb86f04045b067b399491f9fc68b79d7ae48fb7919c09","observation_id":"5da000a6-6f28-4bb8-a419-c89eaface675","resolution":{"observed_at":"2026-08-12T19:21:50.289428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10196","last_updated":"2018-02-26T15:33:34Z","snapshot_observed_at":"2026-08-15T04:29:56.166616Z","submitted_at":"2017-10-27T15:28:35Z","title":"Progressive Growing of GANs for Improved Quality, Stability, and Variation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10196","snapshot_observed_at":"2026-08-12T19:21:50.305865Z","title":"arXiv:1710.10196","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.305865Z"},"links":{"cited_paper":"/paper/1710.10196","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:0b6328b3c547fbf115e76cccfb75b1faef64d8722d331fcd7908cdf75b67ac3d","observation_id":"4de3df3a-42d6-4be5-b9a1-66d23656e70c","resolution":{"observed_at":"2026-08-12T19:21:50.305865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05600","last_updated":"2020-10-10T07:46:19Z","snapshot_observed_at":"2026-08-01T16:44:46.833530Z","submitted_at":"2019-07-12T07:37:26Z","title":"Generative Modeling by Estimating Gradients of the Data Distribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05600","snapshot_observed_at":"2026-08-12T19:21:50.498054Z","title":"arXiv:1907.05600","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.498054Z"},"links":{"cited_paper":"/paper/1907.05600","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:ad62718e011b1ee1ad335cd906f9fff9f2fd77d27cf0f1d0b434aa373462344b","observation_id":"969690fe-1d89-4b42-be2e-7c653219ddbe","resolution":{"observed_at":"2026-08-12T19:21:50.498054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.05233","last_updated":"2021-06-01T17:49:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-05-11T17:50:24Z","title":"Diffusion Models Beat GANs on Image Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.05233","snapshot_observed_at":"2026-08-12T19:21:50.244502Z","title":"arXiv:2105.05233","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.244502Z"},"links":{"cited_paper":"/paper/2105.05233","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:6312ef133a0236d6acb7951076166fb074e2f3c8fe8317ad50f79bf4e23fbe44","observation_id":"288e34ae-5753-47c0-852e-3ddaf77428ba","resolution":{"observed_at":"2026-08-12T19:21:50.244502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T19:21:52.016910Z","title":"In 2022 IEEE/CVF Conference on Computer Vision and Pat- tern Recognition (CVPR)","venue":null,"work_id":"3b7c9fa4-be96-410c-b77c-821414e4bab4","year":2022},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.199419Z"},"links":{"citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:d00caac55add216562177417719eeedcdfa296da76b6ec77a1430e05c58c9f59","observation_id":"35029932-ddb2-4333-ac5b-3b9fab0d011f","resolution":{"observed_at":"2026-08-12T19:21:52.024564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11919","last_updated":"2023-11-20T16:54:07Z","snapshot_observed_at":"2026-08-15T00:00:28.461918Z","submitted_at":"2023-11-20T16:54:07Z","title":"An Image is Worth Multiple Words: Multi-attribute Inversion for Constrained Text-to-Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11919","snapshot_observed_at":"2026-08-12T19:21:50.190698Z","title":"arXiv:2311.11919","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-12T19:21:50.190698Z"},"links":{"cited_paper":"/paper/2311.11919","citing_paper":"/paper/2411.10800"},"observation_digest":"sha256:560424f9c8f9f7dfff69b7b6390160f14284a93f733ce610469e35dcaa1fe7d8","observation_id":"f5adf989-fc3c-4316-b157-b22b8200277b","resolution":{"observed_at":"2026-08-12T19:21:50.190698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.10800","last_updated":"2024-11-16T13:32:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T08:48:32.409904Z","submitted_at":"2024-11-16T13:32:18Z","title":"Test-time Conditional Text-to-Image Synthesis Using Diffusion Models"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":1},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2411.10800."}