{"as_of":"2026-08-06T03:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:462086dedb2d479c8b2f4948acef4555df1b9c67b8e28386b127f9f1f012f8d0","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T01:44:22.710205Z","state":"measured"},{"denominator":189,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":189,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":94,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:02:50.001994Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T13:29:51.539140Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2210.00379","last_updated":"2026-02-12T16:09:50Z","snapshot_observed_at":"2026-07-06T13:58:37.592838Z","submitted_at":"2022-10-01T21:35:11Z","title":"NeRF: Neural Radiance Field in 3D Vision: A Comprehensive Review (Updated Post-Gaussian Splatting)","version":8},"reference_index":140,"source":"pdf_text","source_observed_at":"2026-05-24T10:32:20.149563Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2210.00379"},"observation_digest":"sha256:628cc7b302dbe402202110ea90df3c3b29d73ef3bfbbdac1f38d59e5fda522b6","observation_id":"bdf8ed78-c207-4125-b799-4913d7b2971e","resolution":{"observed_at":"2026-05-24T10:34:20.533027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2302.08453","last_updated":"2023-03-20T10:52:26Z","snapshot_observed_at":"2026-07-31T21:11:02.534986Z","submitted_at":"2023-02-16T17:56:08Z","title":"T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T22:47:50.355642Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2302.08453"},"observation_digest":"sha256:721ea5f76fa4e16f58c3f0e047133d3e8ba6e60e4e18b8bcd63347eacc85430e","observation_id":"2764842a-2273-44a9-80a9-3c14c9dfee30","resolution":{"observed_at":"2026-05-16T22:47:50.400569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2303.01469","last_updated":"2023-05-31T06:17:10Z","snapshot_observed_at":"2026-07-06T14:58:02.852672Z","submitted_at":"2023-03-02T18:30:16Z","title":"Consistency Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-13T15:47:28.598205Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2303.01469"},"observation_digest":"sha256:32b0e625101366e86b8385f71375c4a29a901ab82b62e70f12f294383fb890db","observation_id":"20dce26c-f6c9-4f23-8086-572b291a80c0","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2304.09479","last_updated":"2026-05-12T07:05:20Z","snapshot_observed_at":"2026-07-06T15:17:21.441449Z","submitted_at":"2023-04-19T08:03:20Z","title":"DiFaReli++: Diffusion Face Relighting with Consistent Cast Shadows","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T08:42:04.321790Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2304.09479"},"observation_digest":"sha256:022ccb559a92e6c26d25694709226c4e194225cfa83b93c80282479bc9291afd","observation_id":"3fc65082-e7f3-42ae-8dae-fba640ed343a","resolution":{"observed_at":"2026-05-24T08:44:14.130740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2305.16347","last_updated":"2026-04-14T07:08:36Z","snapshot_observed_at":"2026-07-06T15:33:31.386787Z","submitted_at":"2023-05-24T14:48:18Z","title":"Prompt Evolution for Generative AI: A Classifier-Guided Approach","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T08:59:24.602556Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2305.16347"},"observation_digest":"sha256:1c9245afafcd841a754a6bab016516176dacb4e39185dd0c7dc3547f6f6a1564","observation_id":"c123aba8-de3e-4800-b6e4-48d92a7cca4e","resolution":{"observed_at":"2026-05-24T09:04:15.173018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:22:03.530707Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2307.01952"},"observation_digest":"sha256:e4394accc2ca6244442185f45a64fd88200423d3be8fe17660645eff6f5e144c","observation_id":"45d634d4-d80b-498f-be33-6f59c564e938","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T22:52:19.359362Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2307.04725"},"observation_digest":"sha256:5b0729ad151a1b5fc4d558d61525413ff7d321693b457e4dd4f1bb908c8a2a7e","observation_id":"02f79f4c-cc6b-430c-acd4-66152a56093b","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T23:57:08.818348Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2308.06721"},"observation_digest":"sha256:638099adba3b48d9a1b341628594396ef9ca7ae6c5076ed61e0a773da284dc4f","observation_id":"3d88d694-61b1-4990-846b-f4df7c2c3259","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-20T13:03:57.828598Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2308.08089"},"observation_digest":"sha256:07a7023153a2e7692b37d78f7dd980d3f37209242410fb77febfda2b85691e8e","observation_id":"4bd54afd-6a5e-42ae-aca7-603047463c40","resolution":{"observed_at":"2026-05-20T13:03:58.065481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"reference_index":164,"source":"arxiv_source","source_observed_at":"2026-05-15T08:36:19.457852Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2308.16512"},"observation_digest":"sha256:0972a4c2ab1fc486e94e95c32e0d61554f4babd8a4c509b58b1c5353a622c0a1","observation_id":"2c046cec-5907-4c81-a0cb-35e556cc4837","resolution":{"observed_at":"2026-05-15T08:36:19.573457Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2310.06114","last_updated":"2024-09-26T17:14:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-09T19:42:22Z","title":"Learning Interactive Real-World Simulators","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-16T02:15:18.265190Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2310.06114"},"observation_digest":"sha256:1848d6394b0398190c467ad532c2d804584069823e75a23aec5d40f92c3d8561","observation_id":"7b95c5a5-74d7-4fdc-87d7-0c0ce455427f","resolution":{"observed_at":"2026-05-16T02:15:18.693262Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-07-06T16:40:28.142296Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T21:40:43.956642Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2310.19512"},"observation_digest":"sha256:7cfb40154a83abc38a90228affa92ada2ad8d595f52cb6be840c6dd3647d879c","observation_id":"17968458-04fe-42e0-841b-a467d0eca150","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2401.07519","last_updated":"2024-02-02T16:15:22Z","snapshot_observed_at":"2026-07-06T17:15:27.375387Z","submitted_at":"2024-01-15T07:50:18Z","title":"InstantID: Zero-shot Identity-Preserving Generation in Seconds","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T21:02:41.399183Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2401.07519"},"observation_digest":"sha256:1ce29d3a89df270e0880ecb4022fea0fb42e64ef140228c3a82747181ccfe03d","observation_id":"26554b5a-2043-41e6-b1da-e0724043cbdb","resolution":{"observed_at":"2026-05-17T21:02:41.489773Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2401.16764","last_updated":"2026-05-03T08:30:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-30T05:59:00Z","title":"BoostDream: Efficient Refining for High-Quality Text-to-3D Generation from Multi-View Diffusion","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T04:35:57.539388Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2401.16764"},"observation_digest":"sha256:46b3b181689104139d5103cf4154f17d5f98d86bfbda22d1e28052bb40193e32","observation_id":"75f5d5b0-74f9-424b-ad9f-ae273871f9b9","resolution":{"observed_at":"2026-05-24T04:36:00.736190Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2403.05135","last_updated":"2024-03-08T08:08:10Z","snapshot_observed_at":"2026-08-04T23:51:18.339338Z","submitted_at":"2024-03-08T08:08:10Z","title":"ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T19:43:03.310237Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2403.05135"},"observation_digest":"sha256:f14048ecd28d3df63b00ca4e2b5a2f9ab0026d1425d8f3f5763c718aee034089","observation_id":"7b202ce5-b983-44a9-9df1-3edd10b1e140","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-13T02:06:23.410241Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2404.02101"},"observation_digest":"sha256:b6294372577221dba50e0cf942e2aef9107c4acfd419f88b14b9df79975c52c3","observation_id":"78ab5429-a823-4fa5-9e63-173aee7337f1","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T14:58:37.383749Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2405.08748"},"observation_digest":"sha256:6a9405e02a7724a49b75a888c9a2493012a809a0f0fdbabba80f67661aa23d24","observation_id":"40c7ac0e-f72c-4415-a366-1a4b84bb0193","resolution":{"observed_at":"2026-05-16T14:58:37.412582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2409.08248","last_updated":"2026-05-19T07:22:47Z","snapshot_observed_at":"2026-08-01T17:09:07.344749Z","submitted_at":"2024-09-12T17:47:51Z","title":"TextBoost: Boosting Text Encoder for Personalized Text-to-Image Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-23T20:50:21.184443Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2409.08248"},"observation_digest":"sha256:d6b95f893ed4758bcb8c75b7dccf30ad33b729aa63ec7b9d019b64aa1f1ff963","observation_id":"94225b43-da3c-44b2-9511-53771f76c96d","resolution":{"observed_at":"2026-05-23T20:53:26.539359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2410.10629","last_updated":"2024-10-20T14:35:31Z","snapshot_observed_at":"2026-07-06T19:33:08.264958Z","submitted_at":"2024-10-14T15:36:42Z","title":"SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:50.009149Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2410.10629"},"observation_digest":"sha256:14c3924499ca4f49ecebae38ab59b18f55b2dc23813e19dad69fa581cb2c23e8","observation_id":"47b5e893-0e2b-4a04-895e-7b7f32a9ba64","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T14:16:18.521699Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2410.13720"},"observation_digest":"sha256:35410fe7c1cd06b373a399a377c72ee26451890ad1aaeef73fc9ea08dc863d40","observation_id":"758571fd-a831-4955-8a9d-c18f47ea0350","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:34b8afe7d28b58b2cb3cc6cdf21c87b0f6b159229d53111639932bdceef8fdfb","observation_id":"cf7f9cde-43d7-4a40-921f-1846801b588a","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2507.18064","last_updated":"2026-05-01T09:45:37Z","snapshot_observed_at":"2026-08-02T12:29:58.765834Z","submitted_at":"2025-07-24T03:35:20Z","title":"Adapting Large VLMs with Iterative and Manual Instructions for Generative Low-light Enhancement","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T03:04:20.516410Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2507.18064"},"observation_digest":"sha256:e094ad14144b028e8bca23f3bb11e520b8350933ff53ec77a70e9b8e06388ff4","observation_id":"971b1463-4aac-482a-bee5-efb6137713e3","resolution":{"observed_at":"2026-05-19T03:07:00.089556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2507.23372","last_updated":"2026-05-22T03:38:02Z","snapshot_observed_at":"2026-08-01T18:46:29.354743Z","submitted_at":"2025-07-31T09:39:27Z","title":"UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-25T08:14:28.540629Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2507.23372"},"observation_digest":"sha256:08fbc92a81af3de6bec1c89b8a5acb55767847d534efeb0ecca5c7c8dad4d174","observation_id":"b494398e-e282-4e35-87d9-2f46d17112af","resolution":{"observed_at":"2026-05-25T08:15:33.760443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T22:02:50.001994Z","title":"ediff-i: Text-to-image dif- fusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07647","last_updated":"2025-08-11T05:57:59Z","snapshot_observed_at":"2026-08-05T22:02:45.629357Z","submitted_at":"2025-08-11T05:57:59Z","title":"LaRender: Training-Free Occlusion Control in Image Generation via Latent Rendering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:02:50.001994Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2508.07647"},"observation_digest":"sha256:04db49682ebffb0c36e1a468a1c38b6845420784e8b23d658269f099e33dacbf","observation_id":"474696b9-8d40-4138-b547-7d2445b24a9f","resolution":{"observed_at":"2026-08-05T22:02:50.001994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T18:41:30.780764Z","title":"ediff-i: Text-to-image diffusion models with ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14413","last_updated":"2025-08-20T04:21:26Z","snapshot_observed_at":"2026-08-05T18:40:00.924288Z","submitted_at":"2025-08-20T04:21:26Z","title":"Disentanglement in T-space for Faster and Distributed Training of Diffusion Models with Fewer Latent-states","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T18:41:30.780764Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2508.14413"},"observation_digest":"sha256:fb5b658685f0b1846fe50cb5541b22ee9a7a7801235330db83b605ed42912fbf","observation_id":"eb7e1a1c-5734-40e6-be3c-6219bf1c564e","resolution":{"observed_at":"2026-08-05T18:41:30.780764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T18:37:17.304373Z","title":"ediff-i: Text-to-image dif- fusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14441","last_updated":"2025-08-20T05:53:05Z","snapshot_observed_at":"2026-08-05T18:37:15.366913Z","submitted_at":"2025-08-20T05:53:05Z","title":"FBI: Learning Dexterous In-hand Manipulation with Dynamic Visuotactile Shortcut Policy","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T18:37:17.304373Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2508.14441"},"observation_digest":"sha256:66dba43a07b1f77b9f0b66c0152391c140f76fc26338fef3d7a57d4769659257","observation_id":"7f098930-233b-4c61-95fa-773a854f20bc","resolution":{"observed_at":"2026-08-05T18:37:17.304373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T17:06:01.024756Z","title":"Balaji, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.17050","last_updated":"2025-08-23T14:55:03Z","snapshot_observed_at":"2026-08-05T17:05:40.298074Z","submitted_at":"2025-08-23T14:55:03Z","title":"PVNet: Point-Voxel Interaction LiDAR Scene Upsampling Via Diffusion Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T17:06:01.024756Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2508.17050"},"observation_digest":"sha256:b300a21b2e4b8871abb681687594e7136d65b90f4eb40938c52d2b5bcb97bd17","observation_id":"b5ec6584-cfa5-4459-ba90-11305488c884","resolution":{"observed_at":"2026-08-05T17:06:01.024756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T13:02:41.014213Z","title":"ediff-i: Text-to-image dif- fusion models with an ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.01028","last_updated":"2025-09-03T15:01:47Z","snapshot_observed_at":"2026-08-05T13:02:39.795294Z","submitted_at":"2025-08-31T23:36:44Z","title":"CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:02:41.014213Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2509.01028"},"observation_digest":"sha256:dc296c2e74f3c4bcb1965ac2a0958dcab5334d1c343d16d8f0e772540e76d8bd","observation_id":"3893f42b-8f57-47a7-8e03-eef69f1cb5b3","resolution":{"observed_at":"2026-08-05T13:02:41.014213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T11:42:08.312655Z","title":"ediffi: Text-to-image diffusion models with an ensemble of expert denoisers.arXiv preprint arXiv:2211.01324, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02466","last_updated":"2025-09-02T16:20:20Z","snapshot_observed_at":"2026-08-05T11:42:07.664777Z","submitted_at":"2025-09-02T16:20:20Z","title":"TeRA: Rethinking Text-guided Realistic 3D Avatar Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T11:42:08.312655Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2509.02466"},"observation_digest":"sha256:47ca2eea0523b153bb01c6ea73518c55b0d0a7fb3bbf6acadc603081ea9df3e2","observation_id":"09184a01-47fa-4191-a0b0-786f9e66bac6","resolution":{"observed_at":"2026-08-05T11:42:08.312655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T10:52:02.104137Z","title":"eDiff-I: text-to-image diffusion models with ensemble of expert denoisers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03680","last_updated":"2025-09-03T19:59:20Z","snapshot_observed_at":"2026-08-05T10:52:01.017496Z","submitted_at":"2025-09-03T19:59:20Z","title":"LuxDiT: Lighting Estimation with Video Diffusion Transformer","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:52:02.104137Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2509.03680"},"observation_digest":"sha256:23d7459395e067051bb975e99a6d7996e8829a9a5a310659e41f630cd07df4e2","observation_id":"3ff10ea4-1236-492a-9fb8-96c01277074a","resolution":{"observed_at":"2026-08-05T10:52:02.104137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T10:24:55.186279Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04126","last_updated":"2025-09-14T00:18:40Z","snapshot_observed_at":"2026-08-05T10:24:49.011461Z","submitted_at":"2025-09-04T11:44:28Z","title":"MEPG:Multi-Expert Planning and Generation for Compositionally-Rich Image Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:24:55.186279Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2509.04126"},"observation_digest":"sha256:3e0c80b9d3bb26b4f64607b7d4b24215b2bc6480b1c5bb965eb9f7a89ace28fd","observation_id":"ed700eef-2748-4f9f-bb7b-d5a258b5aaf1","resolution":{"observed_at":"2026-08-05T10:24:55.186279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2510.21366","last_updated":"2026-04-09T14:57:51Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T11:50:03Z","title":"BADiff: Bandwidth Adaptive Diffusion Model","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T04:31:20.147005Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2510.21366"},"observation_digest":"sha256:2ffbfdec7498a1196245d78858c5d4f163e949aed38d362812a51a7495167772","observation_id":"15b31ab6-c551-4039-a9f1-66e1b0a3951d","resolution":{"observed_at":"2026-05-18T04:32:23.149648Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2511.07756","last_updated":"2026-05-11T15:40:18Z","snapshot_observed_at":"2026-08-03T11:14:03.491358Z","submitted_at":"2025-11-11T02:12:38Z","title":"Determinism of Randomness: Prompt-Residual Seed Shaping for Diffusion Generation","version":6},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T00:13:15.606804Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2511.07756"},"observation_digest":"sha256:6e660286f85554de4d900a89728706aa711f32b980c83c4021fe2c81be8363d5","observation_id":"9d6c44bf-1ede-4ea1-a049-a9693044934b","resolution":{"observed_at":"2026-05-18T00:15:31.754773Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2511.13285","last_updated":"2026-04-29T11:24:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-17T12:02:52Z","title":"SkyReels-Text: Fine-Grained Font-Controllable Text Editing for Poster Design","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-17T21:53:26.925547Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2511.13285"},"observation_digest":"sha256:9f6f1f67a4f0c8578000101faeda9baba3bbc7639adf3c87ee39c70b28eb8767","observation_id":"fefe3a7e-d032-4dcf-897d-76eb4e067756","resolution":{"observed_at":"2026-05-17T21:55:20.229332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2511.17171","last_updated":"2026-05-22T12:44:18Z","snapshot_observed_at":"2026-08-02T04:31:50.136077Z","submitted_at":"2025-11-21T11:45:22Z","title":"FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T20:45:15.034196Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2511.17171"},"observation_digest":"sha256:fb0597d6e3e2e30a3136894310a376425473d33170ee7445453d821adb14b980","observation_id":"d87214ab-67cf-4651-b51e-c6eb10ea12ab","resolution":{"observed_at":"2026-05-17T20:50:15.283812Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2511.17171","last_updated":"2026-05-22T12:44:18Z","snapshot_observed_at":"2026-08-02T04:31:50.136077Z","submitted_at":"2025-11-21T11:45:22Z","title":"FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle","version":6},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T07:17:26.381232Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2511.17171"},"observation_digest":"sha256:8334336a2fe90155736d0a4ca058ab827f30e1b0ec9719e12ac5db7b30476f6d","observation_id":"632eaac9-d5d2-459f-b7b2-4266d9336fda","resolution":{"observed_at":"2026-05-25T07:20:28.831141Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2601.22160","last_updated":"2026-04-10T13:20:41Z","snapshot_observed_at":"2026-08-03T08:11:38.324053Z","submitted_at":"2025-12-13T08:45:03Z","title":"Screen, Cache, and Match: A Training-Free Causality-Consistent Reference Frame Framework for Human Animation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T23:13:09.767909Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2601.22160"},"observation_digest":"sha256:a2fc68d8ffc5354125da28f17e2d5141fcc698451a226a01a05809d10d140d5c","observation_id":"9e9988b7-d6e1-4195-b2ca-0440c21aafab","resolution":{"observed_at":"2026-05-16T23:13:39.301040Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2603.08090","last_updated":"2026-06-30T03:35:03Z","snapshot_observed_at":"2026-07-15T12:51:11.895253Z","submitted_at":"2026-03-09T08:30:28Z","title":"DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T15:16:59.801347Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2603.08090"},"observation_digest":"sha256:1dc56ae10a13a1d98d947ebaf91c17065c09c1e37de10c6137cacf01e745688b","observation_id":"5f44977e-193e-4bf3-a87a-5592d628d969","resolution":{"observed_at":"2026-05-15T15:20:09.021378Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-15T12:51:20.969593Z","title":"arXiv preprint arXiv:2211.01324 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.08090","last_updated":"2026-06-30T03:35:03Z","snapshot_observed_at":"2026-07-15T12:51:11.895253Z","submitted_at":"2026-03-09T08:30:28Z","title":"DSH-Bench: A Difficulty- and Scenario-Aware Benchmark with Hierarchical Subject Taxonomy for Subject-Driven Text-to-Image Generation","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-15T12:51:20.969593Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2603.08090"},"observation_digest":"sha256:783736198da1564becf8d70b8f306764e551a8800b97247d8122beacd0c6f24a","observation_id":"a78a7641-2561-4da6-b075-d196545bf8f6","resolution":{"observed_at":"2026-07-15T12:51:20.969593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2603.08155","last_updated":"2026-05-20T06:27:00Z","snapshot_observed_at":"2026-08-02T10:42:01.827936Z","submitted_at":"2026-03-09T09:37:17Z","title":"C$^2$FG: Control Classifier-Free Guidance via Score Discrepancy Analysis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T15:02:16.208300Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2603.08155"},"observation_digest":"sha256:b130f02b2a0716f96fdf537de0483179dff5b90f0b3fff6b48b62bc32bc1ce90","observation_id":"a0afd2ce-21b2-46fc-b4e6-43f1058deb03","resolution":{"observed_at":"2026-05-15T15:06:10.175696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2603.08155","last_updated":"2026-05-20T06:27:00Z","snapshot_observed_at":"2026-08-02T10:42:01.827936Z","submitted_at":"2026-03-09T09:37:17Z","title":"C$^2$FG: Control Classifier-Free Guidance via Score Discrepancy Analysis","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T12:04:07.443646Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2603.08155"},"observation_digest":"sha256:100068b9b1aae3c4fb24ac58553b3a07d3c320b90535004d6ead7a5391584144","observation_id":"3034ded7-ae14-4f6a-b7d3-70bb11d81576","resolution":{"observed_at":"2026-05-21T12:04:09.476559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-15T12:07:05.640150Z","title":"ediff-i: Text-to-image diffusion models with an ensemble of expert denoisers.arXiv preprint arXiv:2211.01324, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.09241","last_updated":"2026-06-26T11:58:42Z","snapshot_observed_at":"2026-07-15T12:07:03.818843Z","submitted_at":"2026-03-10T06:16:23Z","title":"RAE-NWM: Navigation World Model in Dense Visual Representation Space","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-15T12:07:05.640150Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2603.09241"},"observation_digest":"sha256:588f2955e06beaa80681713d997a10d99803ddeff6d16c16fbd33b9528cd0c0e","observation_id":"70a3f10d-a146-43a8-b2ad-ef9e332b2aae","resolution":{"observed_at":"2026-07-15T12:07:05.640150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-04T05:37:54.863413Z","title":"ediff-i: Text-to-image diffusion models with an ensemble of expert denoisers.arXiv preprint arXiv:2211.01324, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.00933","last_updated":"2026-08-03T02:50:39Z","snapshot_observed_at":"2026-08-06T03:19:26.665284Z","submitted_at":"2026-04-01T14:10:23Z","title":"EmoScene: A Dual-space Dataset for Controllable Affective Image Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T05:37:54.863413Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.00933"},"observation_digest":"sha256:172b8c2ab4f7b9e90f36e1ab91adc83f95e021e606d98630e6d5d4232a64f02f","observation_id":"63f9bc40-804d-440f-b078-c284791897e8","resolution":{"observed_at":"2026-08-04T05:37:54.863413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.05687","last_updated":"2026-04-22T08:35:48Z","snapshot_observed_at":"2026-07-30T10:59:44.086141Z","submitted_at":"2026-04-07T10:37:30Z","title":"3D Smoke Scene Reconstruction Guided by Vision Priors from Multimodal Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:10.507760Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.05687"},"observation_digest":"sha256:ae2fc3b50903fee7ed0a0942735719108daac1768ad09650f24d52be2ef16aa3","observation_id":"0ef16b8a-25dd-4b9d-adee-70a6e9343615","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.06129","last_updated":"2026-04-07T17:40:37Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:40:37Z","title":"PoM: A Linear-Time Replacement for Attention with the Polynomial Mixer","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:20:52.810648Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.06129"},"observation_digest":"sha256:d8fb9aeb62fef6847d859774156d8de916ddc6656aa6b143ce1b5650c0a9bdaa","observation_id":"c956675c-cbfe-4f4d-bf63-5891f02140c3","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.12668","last_updated":"2026-04-14T12:39:13Z","snapshot_observed_at":"2026-07-06T23:00:51.385974Z","submitted_at":"2026-04-14T12:39:13Z","title":"OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:37:25.939058Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.12668"},"observation_digest":"sha256:f1547b0f2208de0c05eda81e40082f9ebbfa4a8ef9d999d5efa61e88fb747109","observation_id":"4422cfb9-91cf-48be-9843-a6641d9e44af","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.13495","last_updated":"2026-04-15T05:30:14Z","snapshot_observed_at":"2026-08-02T15:09:55.311008Z","submitted_at":"2026-04-15T05:30:14Z","title":"ADP-DiT: Text-Guided Diffusion Transformer for Brain Image Generation in Alzheimer's Disease Progression","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T14:27:50.244229Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.13495"},"observation_digest":"sha256:28fc7b92ba41c3bccc7e3ce2f3aa48e107213b2a689616048f6c30d9318fd2bc","observation_id":"2f3a28ab-4758-46d4-b5fe-780ad92178d6","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.13841","last_updated":"2026-04-15T13:13:04Z","snapshot_observed_at":"2026-07-06T23:01:46.092000Z","submitted_at":"2026-04-15T13:13:04Z","title":"DiffMagicFace: Identity Consistent Facial Editing of Real Videos","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T13:00:14.782905Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.13841"},"observation_digest":"sha256:652aed8e90f772d16ba3094ba718154152b200d06fad44b961bdde3dc3596b1d","observation_id":"ded06288-94af-4f76-ab28-11a439e6023e","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.20156","last_updated":"2026-04-22T03:50:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-22T03:50:52Z","title":"Temporally Extended Mixture-of-Experts Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T00:39:39.492135Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.20156"},"observation_digest":"sha256:4750d1abf01b21f4003421d8235aabe49e9f28f6205c39d9cae42d148f634476","observation_id":"078095d8-0147-472c-acaa-8b3449688842","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.25358","last_updated":"2026-04-28T08:25:32Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T08:25:32Z","title":"Benchmarking Layout-Guided Diffusion Models through Unified Semantic-Spatial Evaluation in Closed and Open Settings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T16:58:28.380188Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.25358"},"observation_digest":"sha256:f248adca74268ed7e5cb52739317b29c823a7aacb9a2a015641aea6b7c94314b","observation_id":"75e5cae1-5760-40b1-ba75-a4493a90f105","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-07T08:00:33.307429Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:2f171ad5df1185934f312055bfdb0e99f1165a7da2e80849d1f031a0fa9dfba1","observation_id":"7ad172ae-bb5d-4534-9d8d-1b6d2c7130b8","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2604.27505","last_updated":"2026-05-20T07:08:10Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:54:39Z","title":"Leveraging Verifier-Based Reinforcement Learning in Image Editing","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T09:11:02.183133Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2604.27505"},"observation_digest":"sha256:2dea826f43c2ba3721aca51019d515be677a170b102ca79ecee433818b7e903c","observation_id":"5f1fb990-3ae2-4748-9199-c8f48e649161","resolution":{"observed_at":"2026-05-21T09:14:05.985262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.01799","last_updated":"2026-06-06T07:05:08Z","snapshot_observed_at":"2026-08-03T01:13:04.956310Z","submitted_at":"2026-05-03T09:39:44Z","title":"Embody4D: A Generalist Data Engine for Embodied 4D World Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T19:16:50.004359Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.01799"},"observation_digest":"sha256:5dbb85f1227b1cdad181960f2004e7343d1ad2df6db9e2e4673a39b75b2df23b","observation_id":"c94b9064-742f-4c50-977e-3f5f60bc7520","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.01799","last_updated":"2026-06-06T07:05:08Z","snapshot_observed_at":"2026-08-03T01:13:04.956310Z","submitted_at":"2026-05-03T09:39:44Z","title":"Embody4D: A Generalist Data Engine for Embodied 4D World Modeling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T00:17:39.409452Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.01799"},"observation_digest":"sha256:c2e76a835f31e5397f3e91c4a1c0a952117aaea3635eb9b5ffdf455b4bb598d1","observation_id":"af36eaac-8998-435a-a5bb-540b219ba0b6","resolution":{"observed_at":"2026-07-01T00:25:09.902756Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.06272","last_updated":"2026-05-07T13:47:21Z","snapshot_observed_at":"2026-08-02T22:51:09.359998Z","submitted_at":"2026-05-07T13:47:21Z","title":"A Flow Matching Algorithm for Many-Shot Adaptation to Unseen Distributions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T13:13:22.775999Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.06272"},"observation_digest":"sha256:7d2276abc28d797c117a2074af7f87eba12dc3cc28d0a0f367b09323ab96da6c","observation_id":"f1cbd7d5-a271-4c37-a846-60a2a858c529","resolution":{"observed_at":"2026-05-15T01:44:22.991611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.15684","last_updated":"2026-05-15T07:13:27Z","snapshot_observed_at":"2026-08-02T22:46:51.504070Z","submitted_at":"2026-05-15T07:13:27Z","title":"ElasticDiT: Efficient Diffusion Transformers via Elastic Architecture and Sparse Attention for High-Resolution Image Generation on Mobile Devices","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-20T20:00:27.987481Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.15684"},"observation_digest":"sha256:4653f35265bb862e1a17ecce8b414adad22f12b1eeafe5da81c87e53fe281e5f","observation_id":"78006a91-efd5-46cf-8011-4aa4f4d486ee","resolution":{"observed_at":"2026-05-20T20:03:43.779101Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.16732","last_updated":"2026-05-16T00:52:00Z","snapshot_observed_at":"2026-07-31T16:38:42.574868Z","submitted_at":"2026-05-16T00:52:00Z","title":"DiRotQ: Rotation-Aware Quantization for 4-bit Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T21:48:35.203469Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.16732"},"observation_digest":"sha256:ef9d8a7e9afc8086fddf2ea03589e62e4fca6e8fcf7508f45dd9252265de1bc4","observation_id":"dba62026-e24a-49ee-81dd-825f6bf31fa9","resolution":{"observed_at":"2026-05-19T21:52:48.380410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.18010","last_updated":"2026-05-18T08:05:07Z","snapshot_observed_at":"2026-08-02T12:16:21.427153Z","submitted_at":"2026-05-18T08:05:07Z","title":"Functionalization via Structure Completion and Motion Rectification","version":1},"reference_index":235,"source":"arxiv_source","source_observed_at":"2026-05-20T12:25:07.157086Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.18010"},"observation_digest":"sha256:1c88ce1236fa83d4a5182a746947c3059709d3a13488dcdfac8195e2d1ec0d3f","observation_id":"5f3a5b1d-2f8f-43ab-bff8-ae7d49bdf35d","resolution":{"observed_at":"2026-05-20T12:28:17.055342Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.19532","last_updated":"2026-05-19T08:33:10Z","snapshot_observed_at":"2026-08-02T22:16:23.062173Z","submitted_at":"2026-05-19T08:33:10Z","title":"Boosting Text-to-Image Diffusion Models via Core Token Attention-Based Seed Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T06:25:32.694239Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.19532"},"observation_digest":"sha256:eb0f819d511295dcc360e6b1137e1a04b5ec9a9b08e05b9375ac136e5aca62ef","observation_id":"863a4281-f374-49a6-a2dd-b14c782dcecb","resolution":{"observed_at":"2026-05-20T06:28:05.554995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.20079","last_updated":"2026-05-19T16:34:01Z","snapshot_observed_at":"2026-08-01T20:03:48.478574Z","submitted_at":"2026-05-19T16:34:01Z","title":"Probability-Conserving Flow Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T05:44:00.004160Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.20079"},"observation_digest":"sha256:55abc308c1171c835ecdd8e68ff04431356ae1fb7ce4e07f3b4b970a30b35159","observation_id":"116b8b7b-a159-4256-ae79-42c055c1e030","resolution":{"observed_at":"2026-05-20T05:48:04.580212Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2605.31590","last_updated":"2026-05-29T17:56:09Z","snapshot_observed_at":"2026-07-06T23:40:46.825645Z","submitted_at":"2026-05-29T17:56:09Z","title":"TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T23:11:58.580004Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2605.31590"},"observation_digest":"sha256:cf3cfa6c7605d065b822663d1c38e34098ad5e7b6469453b49b7e7fea75736b6","observation_id":"76e9be83-1093-4ba6-8b1b-1331471cb602","resolution":{"observed_at":"2026-06-28T23:12:46.594052Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.00954","last_updated":"2026-05-31T02:10:34Z","snapshot_observed_at":"2026-08-02T19:44:09.651553Z","submitted_at":"2026-05-31T02:10:34Z","title":"COLLAR: Cascaded Object-Level Latent Refinement for High-Fidelity Conditional Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T17:51:18.190103Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.00954"},"observation_digest":"sha256:317d9d94be86eaf458b0da180d712815788fd00823de4ab898500ab8da5904e1","observation_id":"ee394b25-a001-41d7-ba28-6582004b9f15","resolution":{"observed_at":"2026-06-28T17:52:27.267203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.01825","last_updated":"2026-07-01T05:50:06Z","snapshot_observed_at":"2026-08-05T10:25:09.105468Z","submitted_at":"2026-06-01T07:41:44Z","title":"ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search","version":1},"reference_index":149,"source":"arxiv_source","source_observed_at":"2026-06-28T15:18:17.427707Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.01825"},"observation_digest":"sha256:b3e0b254584dd8d73ad663a467e89919448a701f29f8f5f85c2d8cad4a33a1eb","observation_id":"592ee39d-b797-44be-866a-445beb32c426","resolution":{"observed_at":"2026-07-01T22:36:16.991442Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.01825","last_updated":"2026-07-01T05:50:06Z","snapshot_observed_at":"2026-08-05T10:25:09.105468Z","submitted_at":"2026-06-01T07:41:44Z","title":"ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search","version":2},"reference_index":149,"source":"arxiv_source","source_observed_at":"2026-07-02T23:17:03.456746Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.01825"},"observation_digest":"sha256:51e9e7b493232eed1fa15fc9ec6ac8adbfe3d0a073c6f65faaaf21899879ca62","observation_id":"3ca6233f-727d-4d2b-869a-c15ad2ca206e","resolution":{"observed_at":"2026-07-02T23:17:28.858650Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.04306","last_updated":"2026-06-03T00:25:56Z","snapshot_observed_at":"2026-08-05T10:27:41.050145Z","submitted_at":"2026-06-03T00:25:56Z","title":"Organizational Control Layer: Governance Infrastructure at the Execution Boundary of LLM Agent Systems","version":1},"reference_index":128,"source":"arxiv_source","source_observed_at":"2026-06-28T04:17:18.483765Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.04306"},"observation_digest":"sha256:086c59f84c8c1785fbfa8a2577638293a86100ec8af9f9b5a851fe3e07aced08","observation_id":"80813f2b-ef85-444f-9024-be2fcb752dbf","resolution":{"observed_at":"2026-07-02T11:16:53.831404Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.06477","last_updated":"2026-06-04T17:57:15Z","snapshot_observed_at":"2026-08-02T17:51:25.103694Z","submitted_at":"2026-06-04T17:57:15Z","title":"Complexity-Balanced Diffusion Splitting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T02:21:11.177707Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.06477"},"observation_digest":"sha256:ccd08852487002055523691a67c786991fee0e28b35e60deaf0a60b5bbb7cc5a","observation_id":"f9a6089f-248c-4f82-894f-0a0f5becdf0e","resolution":{"observed_at":"2026-07-02T12:16:56.637155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.08788","last_updated":"2026-06-07T19:11:22Z","snapshot_observed_at":"2026-07-06T23:48:16.585598Z","submitted_at":"2026-06-07T19:11:22Z","title":"MaskAlign: Token-Subset Representation Alignment for Efficient Diffusion Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T18:44:41.266768Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.08788"},"observation_digest":"sha256:ca5979dcf670ad72c00d11977f23a41a391890e3c4b3cf950a37a2532ded58d4","observation_id":"323cfc89-6a58-4935-a83b-80920c050bc4","resolution":{"observed_at":"2026-07-02T22:37:26.166440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.08833","last_updated":"2026-06-07T20:52:35Z","snapshot_observed_at":"2026-07-06T23:48:16.585598Z","submitted_at":"2026-06-07T20:52:35Z","title":"CSFlow: Aligning Flow Matching with Human Contrast Sensitivity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T18:37:11.509883Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.08833"},"observation_digest":"sha256:9c5423176f453f98b8241537b2cc70438ce72b7d62eafcdbfd1dfe88db9d8377","observation_id":"74d7196f-3627-4430-9a2d-fda82e0fc993","resolution":{"observed_at":"2026-07-02T22:47:26.414144Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.10653","last_updated":"2026-06-09T09:59:09Z","snapshot_observed_at":"2026-08-01T14:27:47.156242Z","submitted_at":"2026-06-09T09:59:09Z","title":"STEDiff: Strengthening Text Embedding for Text-to-Image Alignment in Diffusion Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T13:50:32.005383Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.10653"},"observation_digest":"sha256:94ddbe8ea4a44a9847f53fb6c1b8368c656ea06823fd97c3be7c54852e345092","observation_id":"7533b67f-eae5-49ee-b1c5-435156ace6d5","resolution":{"observed_at":"2026-07-03T04:37:36.489148Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.11569","last_updated":"2026-06-10T01:51:51Z","snapshot_observed_at":"2026-08-02T04:33:28.330899Z","submitted_at":"2026-06-10T01:51:51Z","title":"ConsistencyPlanner: Real-time Planning with Fast-Sampling Consistency Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T10:04:48.622730Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.11569"},"observation_digest":"sha256:2efe11d2742c2fab452efd2a902c2a03edcfb1e4b9735ffabe39d4f335b41686","observation_id":"2de775f8-a694-49ff-a8f5-611c43734676","resolution":{"observed_at":"2026-07-03T10:17:58.112745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.11615","last_updated":"2026-06-16T23:04:52Z","snapshot_observed_at":"2026-07-06T23:50:39.386691Z","submitted_at":"2026-06-10T03:28:00Z","title":"Adv-TGD: Adversarial Text-Guided Diffusion for Face Recognition Impersonation Attacks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T10:33:56.918809Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.11615"},"observation_digest":"sha256:7d58574f9217b28d0d5dcbbf49fa9d0dd44a30e0be0adea9fd02a737dd2edba5","observation_id":"c91bb152-83fe-4c6a-8d27-13e0c12f5ad3","resolution":{"observed_at":"2026-07-03T09:07:47.547577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.13303","last_updated":"2026-07-31T12:46:43Z","snapshot_observed_at":"2026-08-05T23:14:35.808235Z","submitted_at":"2026-06-11T12:58:48Z","title":"DuET: Dual Expert Trajectories for Diffusion Image Editing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T06:58:39.254427Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.13303"},"observation_digest":"sha256:18e5fc766cc48999d435636e957a8a8d82d91dc57102acfdc3d088a471b65938","observation_id":"32fcb44b-5a15-4221-bda1-0fde9e3df7dd","resolution":{"observed_at":"2026-07-03T14:38:29.262140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-03T02:13:10.238312Z","title":"eDiff-I: Text-to-image diffusion models with an ensemble of expert denoisers.arXiv preprint arXiv:2211.01324,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.13303","last_updated":"2026-07-31T12:46:43Z","snapshot_observed_at":"2026-08-05T23:14:35.808235Z","submitted_at":"2026-06-11T12:58:48Z","title":"DuET: Dual Expert Trajectories for Diffusion Image Editing","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T02:13:10.238312Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.13303"},"observation_digest":"sha256:58217a123f874e772d9c052108a4f943b52d69a8ca8ff945266ec83ec7e89404","observation_id":"3b46c4a4-81c3-4f20-9507-0fab2330916f","resolution":{"observed_at":"2026-08-03T02:13:10.238312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.17378","last_updated":"2026-06-16T00:26:12Z","snapshot_observed_at":"2026-07-06T23:52:57.359941Z","submitted_at":"2026-06-16T00:26:12Z","title":"RISE: Relay Inference and Online Scheduling for Efficient Edge-Device Collaborative Diffusion Model Services","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T23:38:08.990338Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.17378"},"observation_digest":"sha256:eed1fc31303a9668bf5682e3f8db2d68298b0f70e0a7a25053a13cdc0e797249","observation_id":"efc06d93-3469-4834-992f-0f8e16038a7d","resolution":{"observed_at":"2026-07-03T22:19:00.468637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.18555","last_updated":"2026-06-17T00:08:56Z","snapshot_observed_at":"2026-07-06T23:53:59.519305Z","submitted_at":"2026-06-17T00:08:56Z","title":"Rethinking Text-to-Image as Semantic-Aware Data Augmentation for Indoor Scene Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T21:30:03.573719Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.18555"},"observation_digest":"sha256:67950a9699cf2fa4db5e31721df4809e816c7c61dc8ff240a59fe452b36d2734","observation_id":"6e18caa8-08c0-4162-87ec-ec8d8b7ddbc4","resolution":{"observed_at":"2026-07-04T00:09:14.191479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.19163","last_updated":"2026-06-17T15:06:56Z","snapshot_observed_at":"2026-08-02T16:35:14.235903Z","submitted_at":"2026-06-17T15:06:56Z","title":"Pulse: Training Acceleration for Large Diffusion Models with Automatic Pipeline Parallelism","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T19:36:14.248003Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.19163"},"observation_digest":"sha256:e8588c72413070bfa9f060f4e199bf185afc0d0dcb7f3698289a7eeab84b6656","observation_id":"7d606570-0939-40fd-b486-063c5bdf0256","resolution":{"observed_at":"2026-07-04T02:39:24.667110Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.21033","last_updated":"2026-06-19T01:56:25Z","snapshot_observed_at":"2026-08-02T10:50:07.505622Z","submitted_at":"2026-06-19T01:56:25Z","title":"MoECodec: Image Compression for joint human and machine perception via Mixture-of-Experts","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T13:12:03.271949Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.21033"},"observation_digest":"sha256:99caf729936a97b3ab353024cd567dd0a61a6cd0925da55dac56faca42fce603","observation_id":"b09c4a59-0a3c-461a-ad3d-2ac3471cd191","resolution":{"observed_at":"2026-07-04T07:39:38.907321Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.22875","last_updated":"2026-06-22T05:39:46Z","snapshot_observed_at":"2026-08-02T10:07:26.949688Z","submitted_at":"2026-06-22T05:39:46Z","title":"FedOT: Ownership Verification and Leakage Tracing via Watermarks for Federated LDMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T09:17:07.491073Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.22875"},"observation_digest":"sha256:926a3d512419177ef4b04db441e5997e6d3765deac79616a1e678f6402280db1","observation_id":"403ef28e-650a-4a46-9fc0-59a6d36ac442","resolution":{"observed_at":"2026-07-04T09:59:45.393276Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.26938","last_updated":"2026-06-25T12:13:40Z","snapshot_observed_at":"2026-08-01T16:59:54.324752Z","submitted_at":"2026-06-25T12:13:40Z","title":"Focusing on What Matters: Saliency-Harnessing Accurate Routing for Diffusion MoE","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T05:11:59.761865Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.26938"},"observation_digest":"sha256:0a3e8fe90beb26d0c36d9206c1a6580197e1acffcfc3858f4b3675f7540d8652","observation_id":"d4d60b52-df87-4c8c-8ca9-8e7d707eb520","resolution":{"observed_at":"2026-07-04T13:29:51.540874Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.27637","last_updated":"2026-06-26T01:27:45Z","snapshot_observed_at":"2026-08-02T06:20:27.274533Z","submitted_at":"2026-06-26T01:27:45Z","title":"AI-Generated Image Recognition via Fusion of CNNs and Vision Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T00:33:59.392605Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.27637"},"observation_digest":"sha256:4d2dcad5434a3dc8028c2e5156b12709d34a1fd4ba24d5cefff6c73b89280dad","observation_id":"4b30f1bc-bc11-45a4-b3fc-79f580ebcbfb","resolution":{"observed_at":"2026-07-01T19:06:03.397969Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2606.29360","last_updated":"2026-06-28T12:16:58Z","snapshot_observed_at":"2026-08-03T03:34:11.624752Z","submitted_at":"2026-06-28T12:16:58Z","title":"SAFE-DiT: Semantics-Aware Fast-path Execution for High-Resolution Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T07:17:00.884797Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2606.29360"},"observation_digest":"sha256:751d087363dab925ed3e2480a28c616d879cfe1332806b05902ec53284e54368","observation_id":"1ba04c0a-de4a-47d6-8371-d1871574de49","resolution":{"observed_at":"2026-06-30T07:24:21.748192Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":"2211.01324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-04T13:29:51.539140Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","venue":"cs.CV","work_id":"2cd7b629-ab37-4ce5-b51e-aa4d99547468","year":2022},"citing_paper":{"arxiv_id":"2607.02291","last_updated":"2026-07-02T15:08:56Z","snapshot_observed_at":"2026-07-07T00:07:47.719699Z","submitted_at":"2026-07-02T15:08:56Z","title":"Optimizing Visual Generative Models via Distribution-wise Rewards","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T16:39:12.711424Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.02291"},"observation_digest":"sha256:da4e17a90208aa82dfbad1fe0c4f771de810e72d79e0da4ca80c558d756d12e1","observation_id":"f11b654e-51df-40de-9ad6-74841788b120","resolution":{"observed_at":"2026-07-03T16:48:39.726373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-11T19:48:08.010459Z","title":"Balaji, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04360","last_updated":"2026-07-05T15:38:35Z","snapshot_observed_at":"2026-08-03T11:47:54.755795Z","submitted_at":"2026-07-05T15:38:35Z","title":"Optimal Mixture-of-Experts Model Averaging for Conditional Generative Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T19:48:08.010459Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.04360"},"observation_digest":"sha256:118dea7b526b9051ea35b83d7657993ccb8b4fe73fe3e86d8a041a59c67c3341","observation_id":"91c4045d-aad2-43a8-8419-1cf8bf88fa2c","resolution":{"observed_at":"2026-07-11T19:48:08.010459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-02T06:23:23.294557Z","title":"arXiv:2211.01324 , eprint =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12752","last_updated":"2026-07-15T04:28:35Z","snapshot_observed_at":"2026-08-05T06:48:07.037320Z","submitted_at":"2026-07-14T13:19:06Z","title":"Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T06:23:23.294557Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.12752"},"observation_digest":"sha256:44eb1ac073029eab5d6b14ae7beaa7bd60c4ba02be5f6238ff6a2894c50a5596","observation_id":"2c1f4619-9ebb-4c3b-984e-ca4b27f2c709","resolution":{"observed_at":"2026-08-02T06:23:23.294557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-02T00:41:54.121638Z","title":"arXiv preprint arXiv:2211.01324 (2022) 3","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14945","last_updated":"2026-07-16T12:53:45Z","snapshot_observed_at":"2026-08-05T15:38:59.010980Z","submitted_at":"2026-07-16T12:53:45Z","title":"Introspective Attention Modulation for Safe Text-to-Image Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T00:41:54.121638Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.14945"},"observation_digest":"sha256:696b20404d4893ced05533f4d10b300e744cd09ce434e19da29019e299ed8f00","observation_id":"3b2881d0-99ad-4893-8595-809eba40e1ad","resolution":{"observed_at":"2026-08-02T00:41:54.121638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-01T12:45:13.854800Z","title":"arXiv preprint arXiv:2211.01324 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19344","last_updated":"2026-07-21T17:59:12Z","snapshot_observed_at":"2026-08-03T17:08:06.996179Z","submitted_at":"2026-07-21T17:59:12Z","title":"Appearance Pointers -- Multimodal Region Control of Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T12:45:13.854800Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.19344"},"observation_digest":"sha256:1fd04f3f27c547277eea952073fb784d1e4b37dd64d7b6e9324714a7e2300f3b","observation_id":"0333dbdc-5bc2-44a7-a0ef-ea1b9b1d4ae1","resolution":{"observed_at":"2026-08-01T12:45:13.854800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-01T11:59:45.757337Z","title":"ediff-i: Text-to-image diffusion models with an ensemble of expert denoisers.arXiv preprint arXiv:2211.01324, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19725","last_updated":"2026-07-22T03:53:07Z","snapshot_observed_at":"2026-08-01T11:59:43.251331Z","submitted_at":"2026-07-22T03:53:07Z","title":"Analytic Distribution of Classifier-Free Guidance for Schedule Design","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T11:59:45.757337Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.19725"},"observation_digest":"sha256:7e13caaea133d008f7305a35ed77283a260c4ad6b74e0fbda0647950fb5afb2b","observation_id":"768077b8-d5ce-4eb7-b6f6-3fb4cfb685dd","resolution":{"observed_at":"2026-08-01T11:59:45.757337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-01T10:59:51.981486Z","title":"ediff-i: Text-to-image diffusion models with an ensemble of expert denoisers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20048","last_updated":"2026-07-22T11:42:42Z","snapshot_observed_at":"2026-08-05T09:15:47.648858Z","submitted_at":"2026-07-22T11:42:42Z","title":"Importance-Aware OBS Pruning for Diffusion Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T10:59:51.981486Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.20048"},"observation_digest":"sha256:0e8b0f1512cbfd9bd9cb49cddf218966998e7ec05ae05b74406bf830900d8162","observation_id":"4c1f5d14-d50a-4287-bea3-afa40e71e8ce","resolution":{"observed_at":"2026-08-01T10:59:51.981486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-01T07:02:44.077941Z","title":"arXiv preprint arXiv:2211.01324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21594","last_updated":"2026-07-23T17:59:58Z","snapshot_observed_at":"2026-08-04T08:13:52.328599Z","submitted_at":"2026-07-23T17:59:58Z","title":"Streaming Multi-Agent Autoregressive Diffusion Model with World State Registers","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T07:02:44.077941Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.21594"},"observation_digest":"sha256:74b62c7d9cd5516843fe5b4963c31d8d57f97167e14edd0b85184b6fe82b513a","observation_id":"7e40a7fe-6e16-46c4-88b5-342ec5ee45da","resolution":{"observed_at":"2026-08-01T07:02:44.077941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-01T16:42:34.659798Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers , journal =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26404","last_updated":"2026-07-29T02:35:55Z","snapshot_observed_at":"2026-08-03T19:06:45.585998Z","submitted_at":"2026-07-29T02:35:55Z","title":"Examining the Efficacy of Graph Neural Network Message-Passing in Regression Contexts","version":1},"reference_index":270,"source":"arxiv_source","source_observed_at":"2026-08-01T16:42:34.659798Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.26404"},"observation_digest":"sha256:95d2f42d94b119f7e3ea84cc32e8646ee1440158fff7986ecb80756c57d3d399","observation_id":"4d83819e-b363-46b9-92a2-4fa3014e4eea","resolution":{"observed_at":"2026-08-01T16:42:34.659798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-30T11:31:17.370808Z","title":"arXiv preprint arXiv:2211.01324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27110","last_updated":"2026-08-03T12:29:16Z","snapshot_observed_at":"2026-08-06T03:20:11.134835Z","submitted_at":"2026-07-29T16:38:47Z","title":"FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-30T11:31:17.370808Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.27110"},"observation_digest":"sha256:c3b329ee2cff5b43e9a77b4e112a80ef098a76318079e58eab56c0ba74003417","observation_id":"3c7d0b8a-9207-478d-bd2b-28e6ad759ff6","resolution":{"observed_at":"2026-07-30T11:31:17.370808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-04T03:20:56.789479Z","title":"arXiv preprint arXiv:2211.01324 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27110","last_updated":"2026-08-03T12:29:16Z","snapshot_observed_at":"2026-08-06T03:20:11.134835Z","submitted_at":"2026-07-29T16:38:47Z","title":"FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T03:20:56.789479Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.27110"},"observation_digest":"sha256:481512531f04cbfcbdbc8df59dd4fb7dd6bb2c1bb4a8555a29f36c6f033b6b47","observation_id":"d3962ce7-a07e-4725-a59d-30d7d5167857","resolution":{"observed_at":"2026-08-04T03:20:56.789479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-07-31T13:00:40.259984Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28261","last_updated":"2026-08-02T14:44:50Z","snapshot_observed_at":"2026-08-06T03:15:40.984192Z","submitted_at":"2026-07-30T14:18:43Z","title":"TARS: Timestep-Aware Data Scaling for 3D-Free Video Re-Shooting","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-07-31T13:00:40.259984Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2607.28261"},"observation_digest":"sha256:d9b394d7b1b61cd49a030e1eb982924bc974ff48e607343ad1f9ce3c442e75cf","observation_id":"92edbf98-2731-4425-8c69-e39f8da5cfd3","resolution":{"observed_at":"2026-07-31T13:00:40.259984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01324","snapshot_observed_at":"2026-08-05T14:08:36.703422Z","title":"eDiff-I: Text- to-Image Diffusion Models with Ensemble of Expert Denoisers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.03721","last_updated":"2026-08-04T14:19:59Z","snapshot_observed_at":"2026-08-06T02:34:59.894256Z","submitted_at":"2026-08-04T14:19:59Z","title":"On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T14:08:36.703422Z"},"links":{"cited_paper":"/paper/2211.01324","citing_paper":"/paper/2608.03721"},"observation_digest":"sha256:6338d97e1d94dfa329a28dc0856f2dce4423e3b3e60ca1ad91da43dd1efb575c","observation_id":"998dc0e0-7e14-483f-8c4c-891eb963a1bb","resolution":{"observed_at":"2026-08-05T14:08:36.703422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2211.01324/citation-record","integrity":"/paper/2211.01324/integrity","json":"/paper/2211.01324/citation-record.json","paper":"/paper/2211.01324"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.10684","last_updated":"2022-10-26T16:14:05Z","snapshot_observed_at":"2026-08-03T02:24:22.577450Z","submitted_at":"2021-12-20T17:05:11Z","title":"Efficient Large Scale Language Modeling with Mixtures of Experts","version":2},"cited_work":{"arxiv_id":"2112.10684","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2112.10684","snapshot_observed_at":"2026-07-01T22:36:16.721505Z","title":"Artetxe et al., Efficient Large-Scale Language Modeling with Mixture of Experts","venue":null,"work_id":"711d98e0-b9e1-4350-b81d-a621de85a6bb","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2112.10684","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:08d440bd0cafd979f9f551bdb73bfbd92ca670b64f1c06e033fe051550971de0","observation_id":"4cfcdc35-95fd-4e6d-9bea-35bfe4e126f3","resolution":{"observed_at":"2026-05-15T01:44:22.789288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02779","last_updated":"2023-04-30T17:43:11Z","snapshot_observed_at":"2026-07-06T13:17:58.620860Z","submitted_at":"2022-06-06T17:58:04Z","title":"Blended Latent Diffusion","version":2},"cited_work":{"arxiv_id":"2206.02779","doi":"10.48550/arxiv.2206.02779","metadata_source":"arxiv_reference","pith_arxiv_id":"2206.02779","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2206.02779 , year=","venue":"arXiv (Cornell University)","work_id":"1aef642e-c5e8-42d8-a391-f41998245355","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2206.02779","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:ff32c1c2c5b6a6585c815892f2d86811ac1d191f37b7c01e007cf3975509d42b","observation_id":"96e6915f-ccb4-40c1-b904-7c981be28cec","resolution":{"observed_at":"2026-05-15T01:44:22.747418Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Blended diffusion for text-driven editing of natural images","venue":null,"work_id":"b7d69bd8-2483-45c0-93f6-0bf59101b935","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:220b2a489fd1ae13544d759ef06a79cb96f2678ed16ace20c77808176fcd4216","observation_id":"e0248014-4cd4-44b8-a626-6cb267d67067","resolution":{"observed_at":"2026-05-15T01:44:22.931947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Estimating the optimal covariance with imperfect mean in diffusion probabilistic models","venue":null,"work_id":"6a02cf87-87e3-4e01-8807-1815408583fe","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e6709ddc5991fef453223eb8fa21e3c855a8752ef44e01dc04e7ab0d01be85ef","observation_id":"06bd2e55-cf1b-4ca1-9c54-d58ef5f55195","resolution":{"observed_at":"2026-05-15T01:44:22.934122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Analytic- DPM: An analytic estimate of the optimal reverse variance in diffusion probabilistic models","venue":null,"work_id":"83033437-6996-4dfd-9f0f-41f417388b99","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:94d5215cea865fd9f7745c680538acdfd3f25f46c644b836e8807215c65fdce4","observation_id":"f7f5fc54-3b53-4f2a-9aa7-c76684be0834","resolution":{"observed_at":"2026-05-15T01:44:22.936164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10951","last_updated":"2023-03-23T21:31:18Z","snapshot_observed_at":"2026-08-05T18:07:02.649238Z","submitted_at":"2021-03-19T17:59:08Z","title":"Paint by Word","version":3},"cited_work":{"arxiv_id":"2103.10951","doi":"10.48550/arxiv.2103.10951","metadata_source":"arxiv_reference","pith_arxiv_id":"2103.10951","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2021 , journal =","venue":"arXiv (Cornell University)","work_id":"34137c1a-a794-46f0-90ed-ed2d3e8e856f","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2103.10951","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:40cfb09047608f16b1f890bed5881a58b2b7837993527bac77e2484a023ed2ae","observation_id":"e0a1bb80-58bd-496e-a983-ebe519f29acf","resolution":{"observed_at":"2026-05-15T01:44:22.751402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semi-Parametric Neural Image Synthesis","venue":null,"work_id":"9c767c04-e7ec-440a-a94d-bfc2fd4fe310","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d7ec651dea19ecb18984d8f4b33182696b7be434eef017c7b942362a0fe9562b","observation_id":"16cfe5b7-4b2b-419d-9eea-26467d06b0d1","resolution":{"observed_at":"2026-05-15T01:44:22.940165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Sub- biah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et al","venue":null,"work_id":"9f600c7e-9f2c-47be-8c6f-d5641514baf1","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:00afbeb7dd0c9b6174f009f6e914fbc21687355d9d50150938cff987e7bf2d4c","observation_id":"8bdaa08c-f548-41bf-98ef-1073d0590f2c","resolution":{"observed_at":"2026-05-15T01:44:22.942657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14491","last_updated":"2022-11-22T02:09:38Z","snapshot_observed_at":"2026-08-03T22:24:49.500281Z","submitted_at":"2022-09-29T00:57:28Z","title":"Re-Imagen: Retrieval-Augmented Text-to-Image Generator","version":3},"cited_work":{"arxiv_id":"2209.14491","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.14491","snapshot_observed_at":"2026-07-04T13:19:51.137014Z","title":"Re-imagen: Retrieval-augmented text-to-image generator","venue":null,"work_id":"3b99c692-394e-4df1-aede-f245b6e75ed8","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2209.14491","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:54762690210308823582c9dfd4c2975c089c3f0bf92b438cad36850c7a897c4f","observation_id":"1fbfb04f-8ef9-4145-8dc6-4133e4029d08","resolution":{"observed_at":"2026-05-15T01:44:22.755533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":"2204.02311","doi":"10.48550/arxiv.2204.02311","metadata_source":"pith","pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLM: Scaling Language Modeling with Pathways","venue":"cs.CL","work_id":"a94f3ef7-2c49-4445-93fe-6ec16aafd966","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:c1223e77a137102e749668d2ba6be36bf6d4540b30c3bed9606c61fa8f22f1dd","observation_id":"0e5fb1cf-e8b8-4fe3-97cd-c5f9b975fece","resolution":{"observed_at":"2026-05-15T01:44:22.759067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T12:25:21.411055+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving diffusion models for inverse problems using manifold constraints","venue":null,"work_id":"7bbcf6ae-5786-4fa5-9add-5395d13dbf24","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:c1c22b53ef1c801e28167755ec3ec641177527775006d6ffd538f78691b196ce","observation_id":"f1925581-ac49-4bd2-b550-fc83f3d6f2fd","resolution":{"observed_at":"2026-05-15T01:44:22.948948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11427","last_updated":"2022-10-20T17:16:37Z","snapshot_observed_at":"2026-08-01T15:07:11.635426Z","submitted_at":"2022-10-20T17:16:37Z","title":"DiffEdit: Diffusion-based semantic image editing with mask guidance","version":1},"cited_work":{"arxiv_id":"2210.11427","doi":"10.48550/arxiv.2210.11427","metadata_source":"pith","pith_arxiv_id":"2210.11427","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffedit: Diffusion-based semantic image editing with mask guidance","venue":"cs.CV","work_id":"e0e59c16-b6da-4ec1-9bf5-488374e2cde5","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2210.11427","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:17b2146eb50139f321d803f1b425b584eb1a1781b3944714124898d719cf1b40","observation_id":"0101af1d-0f1d-4eb1-947a-81383b86f351","resolution":{"observed_at":"2026-05-15T01:44:22.763483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models beat GANs on image synthesis","venue":null,"work_id":"e554e606-c2ba-43d7-afb3-4c297ccfbaed","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:daa8e1b9971c310cb4ea98415a4c7de775ccca8acb64090a77092c8cabf8d71c","observation_id":"edce3746-14fc-4d51-bb8b-4dc0d25f16f6","resolution":{"observed_at":"2026-05-15T01:44:22.953231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09929","last_updated":"2023-12-31T01:24:45Z","snapshot_observed_at":"2026-07-06T14:07:15.678393Z","submitted_at":"2022-10-18T15:20:47Z","title":"Differentially Private Diffusion Models","version":3},"cited_work":{"arxiv_id":"2210.09929","doi":"10.48550/arxiv.2210.09929","metadata_source":"arxiv_reference","pith_arxiv_id":"2210.09929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Differentially private diffusion models","venue":"arXiv (Cornell University)","work_id":"aca33393-7661-4a15-a84a-6dffdbb3b1a0","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2210.09929","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:b68764f7e1989e1f30c3177f657960689df89d5dd10de1ca281c5fd6e09644fd","observation_id":"c5591587-d3e4-409d-befa-6bfc711f906d","resolution":{"observed_at":"2026-05-15T01:44:22.767374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GENIE: Higher-order denoising diffusion solvers","venue":null,"work_id":"b5aa13c5-35be-4849-afa5-625b7e0b8929","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:b7ca686158940bbd0be27369a8dbd37e7f1f6b82aa9ce619138d74a49d09b46f","observation_id":"a8a8fbe6-f931-48b2-bc36-c64d1c399a94","resolution":{"observed_at":"2026-05-15T01:44:22.957290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score- based generative modeling with critically-damped Langevin diffusion","venue":null,"work_id":"8fcf496c-12a2-48ff-9650-378f8baddb03","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:5ccad81a39e6ce13218c9df4cd9a317ed3c10d4fe0be330ca8cbacbc0d3ac623","observation_id":"93284660-d9df-4aca-9a2e-67dfe01522a8","resolution":{"observed_at":"2026-05-15T01:44:22.959390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13131","last_updated":"2022-03-24T15:44:50Z","snapshot_observed_at":"2026-07-06T12:52:02.246996Z","submitted_at":"2022-03-24T15:44:50Z","title":"Make-A-Scene: Scene-Based Text-to-Image Generation with Human Priors","version":1},"cited_work":{"arxiv_id":"2203.13131","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.13131","snapshot_observed_at":"2026-06-29T23:04:01.962523Z","title":"Make-a-Scene","venue":null,"work_id":"2c99d6c4-d1c6-4714-95e0-006639b9ac5c","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2203.13131","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:9edfe4e3c699ecff855384c6bf0d0bbe6cdab13b717890d57b1457d29c21e304","observation_id":"ed82296c-576b-4c67-870b-f8a6d783e25f","resolution":{"observed_at":"2026-05-15T01:44:22.771350Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01618","last_updated":"2022-08-02T17:50:36Z","snapshot_observed_at":"2026-08-02T23:40:32.342515Z","submitted_at":"2022-08-02T17:50:36Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","version":1},"cited_work":{"arxiv_id":"2208.01618","doi":"10.48550/arxiv.2208.01618","metadata_source":"pith","pith_arxiv_id":"2208.01618","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth One Word: Personalizing Text-to-Image Generation using Textual Inversion","venue":"cs.CV","work_id":"ca618c21-3ba6-448e-bd86-bcecff3cdeb5","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2208.01618","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:634a403a06217561e28e8f9d6fbb7e24a7f015633d55c7acb4773659b7dc1db3","observation_id":"a2ddae1b-1548-4a2a-a7ed-19dffcb59f0d","resolution":{"observed_at":"2026-05-15T01:44:22.774581Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vector quan- tized diffusion model for text-to-image synthesis","venue":null,"work_id":"0e26f057-ceb9-42ef-ba0f-92ff5b075442","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:8dc3012a2729b13c72b80c578d57af10e3f50070239184745f9054f6f9e9b3d7","observation_id":"6861b754-c203-4aa0-b5e9-1ad46753b053","resolution":{"observed_at":"2026-05-15T01:44:22.965929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11495","last_updated":"2022-12-15T20:57:59Z","snapshot_observed_at":"2026-07-06T13:12:59.688989Z","submitted_at":"2022-05-23T17:51:48Z","title":"Flexible Diffusion Modeling of Long Videos","version":3},"cited_work":{"arxiv_id":"2205.11495","doi":"10.48550/arxiv.2205.11495","metadata_source":"arxiv_reference","pith_arxiv_id":"2205.11495","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flexible diffusion modeling of long videos","venue":"arXiv (Cornell University)","work_id":"ea21a47c-f4b3-49bb-91fa-c68fd79c77e3","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2205.11495","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e700c8732d0f5d75a9717e95407495d61cf02a6e206ce6d5e9af8c472b180211","observation_id":"bca94485-57b3-4344-acba-318a655fac47","resolution":{"observed_at":"2026-05-15T01:44:22.778510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14701","last_updated":"2020-11-06T04:16:36Z","snapshot_observed_at":"2026-07-06T10:09:17.078776Z","submitted_at":"2020-10-28T02:17:24Z","title":"Scaling Laws for Autoregressive Generative Modeling","version":2},"cited_work":{"arxiv_id":"2010.14701","doi":"10.48550/arxiv.2010.14701","metadata_source":"pith","pith_arxiv_id":"2010.14701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Autoregressive Generative Modeling","venue":"cs.LG","work_id":"1f180c21-02d6-4b11-9dfc-08d7f0d8fc81","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2010.14701","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:4b8bbae403faa1bff727bcba18cc099e674b94df3f5dc3e08eae28dd1093f583","observation_id":"af63918c-b025-4525-9679-939864f63423","resolution":{"observed_at":"2026-05-15T01:44:22.781916Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":"2208.01626","doi":"10.48500/arxiv.2208.01626","metadata_source":"pith","pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","venue":"cs.CV","work_id":"196f7eef-d65a-47e4-b815-9a188f6aedcf","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:46150421f9b543a062a8713e3e778c8ed537455e2aa0e3b1170c63381e5bae0b","observation_id":"2ec3655f-cd4d-4a21-b47e-95f71a26e2f8","resolution":{"observed_at":"2026-05-15T01:44:22.785529Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00409","last_updated":"2017-12-01T17:13:14Z","snapshot_observed_at":"2026-07-06T06:12:18.811024Z","submitted_at":"2017-12-01T17:13:14Z","title":"Deep Learning Scaling is Predictable, Empirically","version":1},"cited_work":{"arxiv_id":"1712.00409","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.00409","snapshot_observed_at":"2026-07-04T18:40:03.351817Z","title":"Deep Learning Scaling is Predictable, Empirically","venue":"cs.LG","work_id":"3638ccb4-3a4f-460e-8b6f-867a65922801","year":2017},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/1712.00409","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:6383870ac7daf259209cac5fb8d83a340d0394b007433d9d85bc9383c003cca1","observation_id":"a502432f-8db1-48ee-b10c-840050cbd313","resolution":{"observed_at":"2026-05-15T01:44:22.742944Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":"e309f7c3-caff-421b-a32c-df16108cd59d","year":2017},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:516e57d97ba160b3d4f5811e229a1443336d6bd7c5eefc7e96981d8f4a787798","observation_id":"71502766-3199-4882-8103-17175225866a","resolution":{"observed_at":"2026-05-15T01:44:22.975987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.02303","doi":"10.48550/arxiv.2210.02303","metadata_source":"pith","pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":"cs.CV","work_id":"bb20d241-dc6f-4b0a-b071-fd43a2cbd57f","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:8b9b70f19b4b4d97e4ac8b07d2b19cdaf4ca961f4d3ccb1980d357812fa6a4af","observation_id":"d9b86598-1fb0-481b-a3c4-0f796ee15abd","resolution":{"observed_at":"2026-05-15T01:44:22.792960Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:59.676131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"41fe1fcf-bca9-4c79-b6cb-1d41fcc9bdbc","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d4cbfcc79ae02ea55f62e0cccdb02124885f0195c398986ff341b4e83d2ecc2c","observation_id":"d64444c0-ed2a-4645-a4ff-4794030c2c54","resolution":{"observed_at":"2026-05-15T01:44:22.980712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fleet, Mohammad Norouzi, and Tim Salimans","venue":null,"work_id":"d28eabd0-cb10-4bc3-93cc-3492540a9cdd","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:b47f48ac9455b2f0979eab03ec844d2391deac601a97f3292c1baa6860c7774e","observation_id":"3af1b140-a25a-4315-9acd-713e288c105f","resolution":{"observed_at":"2026-05-15T01:44:22.982818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Classiﬁer-free diffusion guidance","venue":null,"work_id":"6266247e-b295-4167-a63e-3b4d3216a3fc","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d173858f2ecc9f32422302c3c4007055985c3b10c753d7f7e7cc44cb86c18132","observation_id":"ae71d0e1-b9ec-49c3-86fc-74893d87e08d","resolution":{"observed_at":"2026-05-15T01:44:22.984720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"661deffd-9044-464b-ab4e-9cfaf821d635","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:96574b47692d955e18c72dbb79d8c8020ac4dd46e8eda6918383db70473add60","observation_id":"713da928-6dbb-47d5-8dca-273214ee4d5c","resolution":{"observed_at":"2026-05-15T01:44:22.986794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal conditional image synthesis with product- of-experts GANs","venue":null,"work_id":"ad5bbf24-e0f2-45ad-85b6-b5f304d06bff","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:fdd4de44d63d1ca2804affa93000ecce188ff97cb52da8f7bb49ee187b6ae0fa","observation_id":"c253ac07-5e7e-47a2-a41b-7d25d9798e75","resolution":{"observed_at":"2026-05-15T01:44:22.988830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Estimation of non-normalized statistical models by score matching","venue":null,"work_id":"d6dcf9c1-030b-4621-854c-a61741cdc4ca","year":2005},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:1a601ea76e388405698aca904e8c686cf1da7b1455a05d7893b63e1897827a02","observation_id":"65ed0c4a-39fc-4f44-bd70-749d758c9f33","resolution":{"observed_at":"2026-05-15T01:44:22.990901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"64e0f771-6e2c-4bdd-bb5a-94a2aaef782f","year":2017},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:959a6a568f650c1f74aaa1abcad7d81220b7a381fe8502f733d79b7843aed7aa","observation_id":"6d670588-9885-41c2-beff-358cba4d52d2","resolution":{"observed_at":"2026-05-15T01:44:22.851104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:bd08c1b2677292982f71fa46fb219724d5ce347e0b2fdb72ad71e6c8b397d806","observation_id":"28e1549b-7fed-42fa-b805-5a3deb7c4026","resolution":{"observed_at":"2026-05-15T01:44:22.796173Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":"25c90e69-bfa1-4e54-9d24-33f44e39df10","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e195f6942751f3c7cb9b153b0cf1f3d7b027c2fe068514cd9d7d057fd84a22e5","observation_id":"b5717a46-70ef-43cc-ba4f-64b259d99028","resolution":{"observed_at":"2026-05-15T01:44:22.856375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion restoration models","venue":null,"work_id":"8be94e58-b1b1-4718-9f39-0697e28ad043","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:c03f8f87a6386f0bc10e0a36db2fc3cb00eb36788bb7edf60268e9f71ff0f5c5","observation_id":"4765c859-fb2b-4e91-8b19-81102673512d","resolution":{"observed_at":"2026-05-15T01:44:22.858761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"JPEG artifact correction using denoising diffusion restoration models","venue":null,"work_id":"d9523b21-0cf3-4241-bb20-833bb5f1ebfa","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:432bbdb9e848be4b060f25c185d883d607cd9ed5d708a7312e08df3d09bbcb33","observation_id":"28b32dd2-6a5f-442e-bb3f-9220ae29e3a0","resolution":{"observed_at":"2026-05-15T01:44:22.860934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09276","last_updated":"2023-03-20T15:58:50Z","snapshot_observed_at":"2026-07-06T14:06:48.707061Z","submitted_at":"2022-10-17T17:27:32Z","title":"Imagic: Text-Based Real Image Editing with Diffusion Models","version":3},"cited_work":{"arxiv_id":"2210.09276","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.09276","snapshot_observed_at":"2026-07-02T23:17:28.942618Z","title":"arXiv preprint arXiv:2210.09276 , year=","venue":null,"work_id":"1788e556-8e11-4023-930c-dbb8fc0121a2","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2210.09276","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:bc88aae43327df7bc73b119f90b9760e8f9e21007b6913e47a91dd1890f1bcd2","observation_id":"d2d4e7b0-3766-4fc1-935a-855a3ccd338b","resolution":{"observed_at":"2026-05-15T01:44:22.800076Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.13435","last_updated":"2023-02-23T13:31:20Z","snapshot_observed_at":"2026-07-06T13:56:50.670071Z","submitted_at":"2022-09-27T14:44:57Z","title":"Scaling Laws For Deep Learning Based Image Reconstruction","version":2},"cited_work":{"arxiv_id":"2209.13435","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.13435","snapshot_observed_at":"2026-07-02T16:07:08.705454Z","title":"Scaling laws for deep learning based image reconstruction","venue":null,"work_id":"378b95e0-8eb2-418b-a607-e1e79791bada","year":2023},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2209.13435","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:246cb3977e860912b6e2af04103746026cf5c343bbef8d860cd97e3c281e7581","observation_id":"911cff8d-3a9b-47b8-8d48-09344cc9fea7","resolution":{"observed_at":"2026-05-15T01:44:22.803125Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DiffWave: A versatile diffusion model for audio synthesis","venue":null,"work_id":"b49530f2-6bbf-46b8-a2ea-2d96023811cb","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:0cae8e90da36943c9030ec01c89be16945f5a7982d0af1108fa64760258fae0f","observation_id":"de748b40-0c38-46f7-8f42-2da104786a49","resolution":{"observed_at":"2026-05-15T01:44:22.867629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shamma, Michael Bernstein, and Li Fei-Fei","venue":null,"work_id":"25f5ba4b-3a28-4688-b6d8-4f75c08e7742","year":2017},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e471271e6c75ad97043cd86ef236aa160120a0917620761b51d406132a7c13c7","observation_id":"b919c1cb-ac17-44a0-bd97-5286d6136579","resolution":{"observed_at":"2026-05-15T01:44:22.869730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14217","last_updated":"2022-05-27T20:12:09Z","snapshot_observed_at":"2026-07-06T13:14:52.308302Z","submitted_at":"2022-05-27T20:12:09Z","title":"Diffusion-LM Improves Controllable Text Generation","version":1},"cited_work":{"arxiv_id":"2205.14217","doi":"10.48550/arxiv.2205.14217","metadata_source":"arxiv_reference","pith_arxiv_id":"2205.14217","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Diffusion- lm improves controllable text generation","venue":"arXiv (Cornell University)","work_id":"fa3c84e2-33fb-4131-b9ae-116e0938f4d7","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2205.14217","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:88f2a494aab84cb2b094b2d74e69f9d4bfdf7c47d7c8b438b344fc58c9d90623","observation_id":"bf2ecf67-d2a1-4b1e-896f-a3302efc7553","resolution":{"observed_at":"2026-05-15T01:44:22.806438Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lawrence Zitnick","venue":null,"work_id":"b9cd85bf-683e-462a-8f7d-355d92d7c102","year":2014},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:18bb8051d1c4792bb75653c82a10e58c2ff4a2c3be9e397a03ce871edd23eb8a","observation_id":"140d7666-2750-46fc-86f4-92068cca4887","resolution":{"observed_at":"2026-05-15T01:44:22.873930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pseudo numerical methods for diffusion models on manifolds","venue":null,"work_id":"5e0a4a42-4eba-4669-a7ee-0293deba86e7","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:52d7a939ee646e57fa9ea0a924d93bb96316ccd846eb531e4b5a7e16f3691ca3","observation_id":"20c0cd8c-9101-4ad6-8b55-9922cd475ff0","resolution":{"observed_at":"2026-05-15T01:44:22.875987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imaginaire","venue":null,"work_id":"2721f6eb-3798-4a12-833a-9de68c2b8b85","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:ed320fde8f33d1039d8c60711daf2683c2d2616e28824e6ba4620005297bfb33","observation_id":"3db6695a-cfa9-4c01-9fb9-14606c2bf699","resolution":{"observed_at":"2026-05-15T01:44:22.878209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"a295d18d-89f3-4d5e-9f2b-a762aee86b5d","year":2019},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:ec1d2f5b109807ccd7299cf1e32a3605774449ff5d8aa695b3a0f68ae6bb1dab","observation_id":"c536e42b-c314-4bcb-9d62-0abf470bdcfb","resolution":{"observed_at":"2026-05-15T01:44:22.880236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DPM-Solver: A fast ODE solver for diffu- sion probabilistic model sampling in around 10 steps","venue":null,"work_id":"b98d5e8e-eeb1-4ad5-ab6b-58df7fd0fec4","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:89f13f18cb1b3ac0657bc0424477dae89fad0615535a073b6a8f507d2b52f0f9","observation_id":"c5e52d17-b3fc-49f9-a9dd-d0aa8d788082","resolution":{"observed_at":"2026-05-15T01:44:22.882527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"RePaint: Inpainting us- ing denoising diffusion probabilistic models","venue":null,"work_id":"49f8af9c-37ca-44dd-9dfa-8d2fc60bffb9","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:6d0cef9b0b69aba24b45c3278244e3452b56e64f8752b7f141a1eb3a171dbfb0","observation_id":"07bcd33a-7e69-4128-b9aa-8c573645c0a6","resolution":{"observed_at":"2026-05-15T01:44:22.886236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04316","last_updated":"2022-07-09T18:21:32Z","snapshot_observed_at":"2026-07-06T13:29:32.211007Z","submitted_at":"2022-07-09T18:21:32Z","title":"Improving Diffusion Model Efficiency Through Patching","version":1},"cited_work":{"arxiv_id":"2207.04316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2207.04316","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving diffusion model efﬁciency through patching.arXiv preprint arXiv:2207.04316","venue":null,"work_id":"0c70eeaa-8f16-471a-bedb-feb737dd2f38","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2207.04316","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:bca0162005478923d3f6a8950634e5423f7cb333470327efb76b0111453a4fa8","observation_id":"092e0232-8153-49ee-a80d-27467c6deec2","resolution":{"observed_at":"2026-05-15T01:44:22.809834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion probabilistic models for 3D point cloud generation","venue":null,"work_id":"ca1c53e5-19c3-476a-99e3-69a525a380a6","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:4902d383f05e354afd4e2fdc5b2122f30ce0639a9a39949048edd50ad79c559c","observation_id":"9b4edcb0-a35a-43e6-97c3-679614052a53","resolution":{"observed_at":"2026-05-15T01:44:22.893209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SDEdit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":"b8e773d8-496e-4a86-bf56-1e89937931a7","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d8328a36cb92ed53e714ca9d48743c8e393f2c767c25b767043bc2ee186a2591","observation_id":"b810f07a-55e1-4600-b264-171769075615","resolution":{"observed_at":"2026-05-15T01:44:22.895304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GLIDE: Towards photorealistic image genera- tion and editing with text-guided diffusion models","venue":null,"work_id":"97cd490e-6e2f-4ee1-ae29-12275bb2ca7e","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:42ea8820f11e8ef1fbf39d3fa965ec3db3d4d09ec8e900f133e59989853a0b1e","observation_id":"4dece804-9451-4355-8db1-8aad6f4fadfd","resolution":{"observed_at":"2026-05-15T01:44:22.897380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffusion models for adver- sarial puriﬁcation","venue":null,"work_id":"27b0fab2-6c48-4b36-8bc8-16fa6744c622","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:7a9fc8c69195fa224f602439b6a7716e1d69f3917154d3dc808427183717423f","observation_id":"b9eb3469-1eda-44f3-be24-b6e31fc808be","resolution":{"observed_at":"2026-05-15T01:44:22.899438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic image synthesis with spatially-adaptive nor- malization","venue":null,"work_id":"90ab60f0-46dc-401e-8892-928e7a25dc81","year":2019},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:6100990e3772f9343ad3556a8e9320e763c3abb22d6604ed6fcb1881fd8c8c7e","observation_id":"7a69962c-9d00-4c5c-8830-4dab6b02704b","resolution":{"observed_at":"2026-05-15T01:44:22.901581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PyTorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"c7eaf7a8-c96c-4e9e-ae05-f613c9a23a45","year":2019},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:6087917194796014eba3e8e4d38e3a5ed46b3b9385e7d9bd613716d29d565072","observation_id":"8de4a19a-e6cf-4de6-9b97-affc0806e97a","resolution":{"observed_at":"2026-05-15T01:44:22.903719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"86536aa3-fcd2-4223-8e92-346e685a66a2","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:9341f819f3dd8bf4512fc5772658726c8f8d93c0f4aee84d5eab5f884868536e","observation_id":"a17cc095-0636-4915-92f0-8c0f1c28bc32","resolution":{"observed_at":"2026-05-15T01:44:22.906261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"213b1c94-8599-441c-996a-10d20b521378","year":2020},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:70280786afbca6c189fc0f8353fcd8880473890a25765c4ce61c37e49b1d1b7c","observation_id":"7314203c-2ae9-4cad-8d59-5f4c79b270c0","resolution":{"observed_at":"2026-05-15T01:44:22.908447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":"2204.06125","doi":"10.48550/arxiv.2204.06125","metadata_source":"pith","pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","venue":"cs.CV","work_id":"0c6a768b-70b8-4242-bb0e-459f1008c9fc","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:63f60844a38ee9b3fa38afbb5ce0b13abb24e881f7c185005e7a9946f4de6fc7","observation_id":"5589e3b5-5838-437e-90fa-b3572cec858f","resolution":{"observed_at":"2026-05-15T01:44:22.812845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.412412+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"75eee6d7-bbc2-4560-92fd-11667bd66236","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:8a0673b92f5b820832b9137824538e342fd595381a949bd42c02d6fac28991dc","observation_id":"2aaaa9a8-e06d-413d-b42b-cc2d7159bcdc","resolution":{"observed_at":"2026-05-15T01:44:22.912758Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling vision with sparse mixture of experts","venue":null,"work_id":"89eddeee-6835-4acf-96f1-6fa6e8eb8161","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:52d23cfdad027d4bcbfa109f64730a77a8d2a972886c04b38998678489989acd","observation_id":"e230708c-e033-4455-b4aa-9f5433c60bfa","resolution":{"observed_at":"2026-05-15T01:44:22.914806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"19d9d8e5-3d5a-475d-9cae-736a44aba60d","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:b5e3fab74726b04ee6a18829b9ea13c93932690691ee2dc127ce40c25d5fb0e9","observation_id":"7803db55-2f72-4eca-9782-be577ac641ae","resolution":{"observed_at":"2026-05-15T01:44:22.917350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stable diffusion v1-4","venue":null,"work_id":"e9509921-c88d-4170-b456-a423f0b2f6b7","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d5aa6e328b0ed8c39d3abbc8a18ccd44ded9e267fb5c60ab74b6365a6e4b6df9","observation_id":"920c1d2d-78cb-4276-875b-5d5a1fc2ac90","resolution":{"observed_at":"2026-05-15T01:44:22.919372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12242","last_updated":"2023-03-15T17:52:27Z","snapshot_observed_at":"2026-07-06T13:45:31.237782Z","submitted_at":"2022-08-25T17:45:49Z","title":"DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation","version":2},"cited_work":{"arxiv_id":"2208.12242","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.12242","snapshot_observed_at":"2026-07-09T18:36:27.290071Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject- driven generation","venue":"cs.CV","work_id":"a531ae3d-a7d0-4cda-a38f-7ccb769014c3","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2208.12242","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:ed69b907048c385769c6118b5a4eb9a9a05470ad0e57e28b38bf30187489c72a","observation_id":"c6899938-8966-40d4-87cb-2d95bea1aae7","resolution":{"observed_at":"2026-05-15T01:44:22.816531Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lee, Jonathan Ho, Tim Salimans, David J","venue":null,"work_id":"1513473f-e851-47da-9bc7-f2e5964cc6b6","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:4b08b5e5d6a379cbe88b5ba7625f4ab7febe7c444903a03ad42904587a855cf8","observation_id":"3af4c88a-4fd2-4506-9cbd-e30ea375f701","resolution":{"observed_at":"2026-05-15T01:44:22.923323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-07-06T13:12:59.688989Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"cited_work":{"arxiv_id":"2205.11487","doi":"10.48550/arxiv.2205.11487","metadata_source":"pith","pith_arxiv_id":"2205.11487","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","venue":"cs.CV","work_id":"af16442b-a46f-469d-8818-c37b53a504c7","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2205.11487","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:2b1a57a16bdcedcce6ba7320c76b7411be8bf4414eb1005836f470812eef9654","observation_id":"df3b422a-a206-4ab5-9d3d-79c9aa46e8cd","resolution":{"observed_at":"2026-05-15T01:44:22.819391Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:50:02.677+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:50:02.677+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fleet, and Mohammad Norouzi","venue":null,"work_id":"79f7ce4a-d18f-45ff-8b14-ff947a43920b","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:a27ee9cc8b2baf8dcd942a2358f42d870f96043025601f7cc245211589fc801b","observation_id":"415e1820-afc6-429e-a54b-98e00fffdf7b","resolution":{"observed_at":"2026-05-15T01:44:22.927667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outra- geously large neural networks: The sparsely-gated mixture- of-experts layer","venue":null,"work_id":"00b097e2-31c4-4217-9dca-031c0a8a850c","year":2017},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:1143f7a9360f149d73adac89663daa3d046dd40278e1d0ab6cf20137d083603c","observation_id":"198eaf8a-95d8-4731-9c4b-7bb03b700caa","resolution":{"observed_at":"2026-05-15T01:44:22.929930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02849","last_updated":"2022-10-02T11:55:59Z","snapshot_observed_at":"2026-07-06T12:57:27.948438Z","submitted_at":"2022-04-06T14:13:35Z","title":"KNN-Diffusion: Image Generation via Large-Scale Retrieval","version":2},"cited_work":{"arxiv_id":"2204.02849","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.02849","snapshot_observed_at":"2026-07-03T19:08:50.387530Z","title":"Knn- diffusion: Image generation via large-scale retrieval","venue":null,"work_id":"de1864b6-5643-4e89-9d34-ecfcaaff795d","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2204.02849","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:ee7f65d5cccf46663f208c6a72fee2d8a8e8852a867c5b7b1dfa8f73c45a698b","observation_id":"0d66d0f9-f879-4097-9484-b421c240e8b2","resolution":{"observed_at":"2026-05-15T01:44:22.822983Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":"2209.14792","doi":"10.48550/arxiv.2209.14792","metadata_source":"pith","pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","venue":"cs.CV","work_id":"52a801fc-a707-45a1-a8cd-0d6702f124ab","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:f4dfc864a9a76010c6730db007a4847d48ad79b5ce3871c95db70b3367b01c46","observation_id":"e39b488c-eccd-456b-8281-6d00da678cfc","resolution":{"observed_at":"2026-05-15T01:44:22.825951Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D2C: Diffusion-decoding models for few-shot condi- tional generation","venue":null,"work_id":"dd3de003-9dfc-47e1-b7a3-f0620949f169","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:62c2bab1bb559ccc63b811073e5d5ac94ea3b964eff9ffa4d02aa5b7cdbaedcb","observation_id":"452e0530-c550-47c2-9f97-19943689359b","resolution":{"observed_at":"2026-05-15T01:44:22.946765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"b0d06a1b-52fa-4d5d-9782-dc1e4b383577","year":2015},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:3d6ec530babe725118e82ac820b30af69deff3a96c7df7d7d25126f3b9b664f6","observation_id":"3f9f7ccf-ec3a-4240-b9c6-efbd9771ad43","resolution":{"observed_at":"2026-05-15T01:44:22.950918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Denoising diffusion implicit models","venue":null,"work_id":"c1088029-6fd7-4a7e-91f2-8b05b9d9672a","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:1a0dea09ae5babc3bc69f38c57e7a7abd8e0c28d882a824b063f65746b2c2afe","observation_id":"8c80d55c-82f8-4570-865b-fc9202b48725","resolution":{"observed_at":"2026-05-15T01:44:22.955195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":"ccd08afa-80aa-4cac-aa39-e262eb95178d","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:fcd2aa8fe64f1d8ad76791b0a2f8a1b5a932564f451c803b352c080a5b352ed7","observation_id":"8d08cc49-f07d-4211-92f5-374f0e6c9309","resolution":{"observed_at":"2026-05-15T01:44:22.961417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved techniques for training score-based generative models","venue":null,"work_id":"5be25ae6-8ab7-4ab6-9c66-95b99102c083","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:4cb1f8e047068550edc57088298109671d059a8a5c01d6cdfb701fd8bffa3919","observation_id":"6b1c8780-4eba-458e-b86a-16f2eeca1bee","resolution":{"observed_at":"2026-05-15T01:44:22.963488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kingma, Ab- hishek Kumar, Stefano Ermon, and Ben Poole","venue":null,"work_id":"a02435fc-bec3-455b-aaf0-b4a25029bd64","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:0f027c961233d7c97b449e9e1c78f73e56d23057481b5ea2b6f37a9777229dd3","observation_id":"88f112d1-d38d-43fb-8d7f-f0bc2c1fa45c","resolution":{"observed_at":"2026-05-15T01:44:22.968048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dropout: a simple way to prevent neural networks from overﬁtting","venue":null,"work_id":"604a1a94-fcde-415a-b361-278b39699727","year":1929},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:36719d9e006ba30f85a57448758e23005a050a93bdc2b7b96472881cbb0e9a7a","observation_id":"5277d88d-ccdf-4e1e-826d-b7a2dd0d7a7c","resolution":{"observed_at":"2026-05-15T01:44:22.970049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The bitter lesson","venue":null,"work_id":"365e887b-96a6-4db2-8f42-1731228f88ec","year":2019},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:edfe7066436cda8ad5f9be5468ac022af45f90a688ce8bd29a7abfee6887a704","observation_id":"7d90f67b-ba2b-44ce-a3c6-681d7f4cc254","resolution":{"observed_at":"2026-05-15T01:44:22.971860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CSDI: Conditional score-based diffusion models for probabilistic time series imputation","venue":null,"work_id":"5446799e-4bff-4f34-94b3-9082018a4b4c","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:921a6f6966da66ed727d7d5fafbc66c2dc27bd07eced626cc4b6a3902d339273","observation_id":"5baae6ff-d428-4d40-8006-e86ca58acf5b","resolution":{"observed_at":"2026-05-15T01:44:22.973881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Score-based generative modeling in latent space","venue":null,"work_id":"4f70d95a-9ed3-42af-ac50-f3a4fd5cabdd","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:1d1b2b53765fdbb563778668bb0965b228bded5882676083877e887cbb0e8fbe","observation_id":"342e8cff-4947-4942-a56d-729c3d89e244","resolution":{"observed_at":"2026-05-15T01:44:22.978808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09477","last_updated":"2023-07-05T12:35:29Z","snapshot_observed_at":"2026-08-04T06:56:41.582512Z","submitted_at":"2022-10-17T23:46:05Z","title":"UniTune: Text-Driven Image Editing by Fine Tuning a Diffusion Model on a Single Image","version":4},"cited_work":{"arxiv_id":"2210.09477","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.09477","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2210.09477 2(3), 5 (2022)","venue":null,"work_id":"6ba11092-4727-411b-81b9-c80548b9509d","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2210.09477","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:844efa5e6cd07102d384d7df94a8ec75388352d63c2802560a0ae9d590469486","observation_id":"a9f7fd8d-4c68-4c9e-b5e3-2e04744c01c3","resolution":{"observed_at":"2026-05-15T01:44:22.829358Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A connection between score matching and denoising autoencoders","venue":null,"work_id":"af20a2e9-a8f2-488e-94ca-34c950e0c3d2","year":2011},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e9f7ef5faa0b249c1c86cb80353964f94cd37bc911ec2a1162e1848e58a2ba9f","observation_id":"9e3f2a95-7845-4716-b4ff-1c05bc9a62a1","resolution":{"observed_at":"2026-05-15T01:44:22.863126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12952","last_updated":"2022-05-25T17:58:26Z","snapshot_observed_at":"2026-08-02T01:00:27.145701Z","submitted_at":"2022-05-25T17:58:26Z","title":"Pretraining is All You Need for Image-to-Image Translation","version":1},"cited_work":{"arxiv_id":"2205.12952","doi":"10.48550/arxiv.2205.12952","metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12952","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLIDE: Towards Photorealistic Image Generation and Editing with Text- Guided Diffusion Models","venue":"arXiv (Cornell University)","work_id":"b9bf6ab6-d937-4831-b509-86e54cf8755c","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2205.12952","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:09655dbb932a1e75f7e354e99c4515f37aee0a0f49e6c5c2209ed65c333f49cc","observation_id":"3760e796-4e4b-47ef-a88c-cce6884e56c7","resolution":{"observed_at":"2026-05-15T01:44:22.832639Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-21T20:52:26.683882+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T20:52:26.683882+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-ESRGAN: Training real-world blind super-resolution with pure synthetic data","venue":null,"work_id":"913f2841-f406-4545-a761-6dbd613902d9","year":2021},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:194d9f5bd806668d36296fee5bb5ec397feda1c3aa0bd8bcaa2cfd089dbe0bfd","observation_id":"62778f05-d04d-49d9-8078-489c41f981c6","resolution":{"observed_at":"2026-05-15T01:44:22.871898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dimakis, and Peyman Milanfar","venue":null,"work_id":"9705ea35-6b65-4600-978c-eadfbd1fcfdf","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:8f8776188f838580ed849c630880e339c481f0a767bf7d4848b123c9c67987ee","observation_id":"152cf2b8-490d-4b6f-b162-0d69e2541fb8","resolution":{"observed_at":"2026-05-15T01:44:22.890857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15611","last_updated":"2022-11-24T04:05:41Z","snapshot_observed_at":"2026-07-06T13:58:22.032846Z","submitted_at":"2022-09-30T17:35:53Z","title":"Protein structure generation via folding diffusion","version":2},"cited_work":{"arxiv_id":"2209.15611","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2209.15611","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wu, Kevin K","venue":null,"work_id":"0a580209-c170-4a63-ad37-b2c2b83f2f7e","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2209.15611","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:b34b4cfae79edb0529c5638b5cd736f985d7ab4d7a07c769f8929539d6efa529","observation_id":"8cd0fa83-a0e7-493a-9b65-7d4d8154aac7","resolution":{"observed_at":"2026-05-15T01:44:22.835657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GeoDiff: A geometric diffusion model for molecular conformation generation","venue":null,"work_id":"45aadf38-b2ac-41ef-9411-a83e488ac86f","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:4a52d1a0f1caeddd20dc246d03b21e8ee54dc6d30ae1ac66111056b49b191d0e","observation_id":"72a64218-e1bb-4176-99ec-85882330f20e","resolution":{"observed_at":"2026-05-15T01:44:22.921449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09481","last_updated":"2022-12-08T01:18:55Z","snapshot_observed_at":"2026-08-05T06:06:54.296418Z","submitted_at":"2022-03-16T03:52:45Z","title":"Diffusion Probabilistic Modeling for Video Generation","version":5},"cited_work":{"arxiv_id":"2203.09481","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.09481","snapshot_observed_at":"2026-07-01T06:55:28.792743Z","title":"Dif- fusion probabilistic modeling for video generation","venue":null,"work_id":"4f5d4c72-112b-4be1-8434-a59613cb8ca2","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2203.09481","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:d9091a5c4642758a35d4f86fd102c5daca3c753ad7f2c2fabc5315cd09751158","observation_id":"c891f352-0d3b-46b8-ab75-16738006d8c0","resolution":{"observed_at":"2026-05-15T01:44:22.838999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10789","last_updated":"2022-06-22T01:11:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-06-22T01:11:29Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":"2206.10789","doi":"10.48550/arxiv.2206.10789","metadata_source":"pith","pith_arxiv_id":"2206.10789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Autoregressive Models for Content-Rich Text-to-Image Generation","venue":"cs.CV","work_id":"0a105815-ff2e-43ce-8566-966cdcae1af4","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2206.10789","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:396561e0826ea525ec15ad36441d8e0a8fbda5b53c8060fed1d9af48122aa809","observation_id":"6dd858a3-a606-40fd-bb39-a89b27ce06c4","resolution":{"observed_at":"2026-05-15T01:44:22.842165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LION: Latent point diffusion models for 3D shape generation","venue":null,"work_id":"055967f7-2fb0-4f36-a792-b0c4ad4190b6","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:68fd672dda6c45d705292518d9e7fe40148cad9b0a6baaaf6aa17b9504d518f5","observation_id":"4d2f3bcf-a6aa-4f43-8c10-8f0b797880f0","resolution":{"observed_at":"2026-05-15T01:44:22.944745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling vision transformers","venue":null,"work_id":"107d20d3-5037-4c84-8723-66ce55e6db84","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:250d330e0f0c3ee1cf06e994af5c3123fbfa6f96c8336598f31e8e01dc294bd5","observation_id":"1e7ef7f6-62a5-44a4-b540-44648fa5e924","resolution":{"observed_at":"2026-05-15T01:44:22.853588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13902","last_updated":"2023-02-25T20:30:35Z","snapshot_observed_at":"2026-07-06T13:04:57.055751Z","submitted_at":"2022-04-29T06:32:38Z","title":"Fast Sampling of Diffusion Models with Exponential Integrator","version":4},"cited_work":{"arxiv_id":"2204.13902","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.13902","snapshot_observed_at":"2026-07-04T15:39:57.095359Z","title":"Fast sampling of diffusion models with exponential integrator.arXiv preprint arXiv:2204.13902","venue":null,"work_id":"1ead7a15-4ec3-4add-968c-6cb18b6ff768","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2204.13902","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:18b77794d19c0e2fea5c5d585b0c7ffb7cf416912adcdfb84daeb5c835c4dbb3","observation_id":"031fa74a-c696-4365-b464-b82d94f367cc","resolution":{"observed_at":"2026-05-15T01:44:22.845483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05564","last_updated":"2023-03-23T11:50:36Z","snapshot_observed_at":"2026-08-01T22:04:45.629414Z","submitted_at":"2022-06-11T16:57:23Z","title":"gDDIM: Generalized denoising diffusion implicit models","version":2},"cited_work":{"arxiv_id":"2206.05564","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2206.05564","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"gddim: Generalized denoising diffusion implicit models","venue":null,"work_id":"5c25a98a-052d-4a40-9c73-5b9857412a5f","year":2022},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"cited_paper":"/paper/2206.05564","citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:be05fe7b6c5b87acedae55292181e1d67c85b74cc6dc3863f80da82c137b9754","observation_id":"3e4bdd47-d64f-4f38-9cce-a3a1f5593f5d","resolution":{"observed_at":"2026-05-15T01:44:22.848754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3D shape generation and completion through point-voxel diffusion","venue":null,"work_id":"09f9314a-a51c-498e-b88e-439638dc9b63","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:64d65acc6e869a751b4bda1f84ba1314683f997c2811bf70de71fd10570e3e42","observation_id":"971c0b62-e323-4609-96c2-58b4c73c26b3","resolution":{"observed_at":"2026-05-15T01:44:22.925422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Network Architecture For our diffusion models, we modify the U-net archi- tecture proposed in Dhariwal et al","venue":null,"work_id":"3b3831f9-9465-486e-be75-9f7b387ababf","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:e3e0889970b9746135e7dceae042efb880051b763d77e4091248ed4e04c3a8cc","observation_id":"afb422b1-8ad7-47cc-906f-8cc360ff0a23","resolution":{"observed_at":"2026-05-15T01:44:22.938163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Different from Saharia et al","venue":null,"work_id":"e2b6bf9f-ee44-4adf-89ad-56d7daaa5775","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:9aa822cda2a7cd9a6cc305ac1fa2fae995f4e335aec042d7fcb4ffa0fb2dc904","observation_id":"12ca0ddc-b2df-431a-b2f4-aefd58adc67e","resolution":{"observed_at":"2026-05-15T01:44:22.865436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[13], we add a cross- attention block to perform cross-attention between im- age embeddings and the conditioning embeddings","venue":null,"work_id":"5768767b-3d1e-4d42-b0ba-90a54f3199fc","year":null},"citing_paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers","version":5},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-15T01:44:22.710205Z"},"links":{"citing_paper":"/paper/2211.01324"},"observation_digest":"sha256:6d779618418dece2cdfe1878d5b20bdeb88ebbf4adf32ee09403627845c975da","observation_id":"2c0690b6-8a86-410b-bf9c-37c5d8a1c66d","resolution":{"observed_at":"2026-05-15T01:44:22.910752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2211.01324","last_updated":"2023-03-14T00:22:14Z","latest_version":5,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-02T17:43:04Z","title":"eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":11,"parse_uncertain":1,"unresolved":3,"verified_exact":20,"verified_fuzzy":60},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 94 inbound Pith citation observations for arXiv:2211.01324."}