{"as_of":"2026-08-13T15:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3cab83265d9876c684b93ed4e7bcab0c4d0a944ff59032dfca5f1420c78f0ba","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:32:27.757791Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T17:51:32.439732Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T17:53:11.730252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"cited_work":{"arxiv_id":"2411.16783","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16783","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cocono: At- tention contrast-and-complete for initial noise optimization in text-to-image synthesis.arXiv preprint arXiv:2411.16783","venue":null,"work_id":"a97fe328-80df-4420-a214-d80fb9331e56","year":null},"citing_paper":{"arxiv_id":"2601.00090","last_updated":"2026-05-01T04:44:00Z","snapshot_observed_at":"2026-08-11T03:47:42.431102Z","submitted_at":"2025-12-31T19:47:49Z","title":"It's Never Too Late: Noise Optimization for Collapse Recovery in Trained Diffusion Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-16T17:51:32.439732Z"},"links":{"cited_paper":"/paper/2411.16783","citing_paper":"/paper/2601.00090"},"observation_digest":"sha256:b523f9081baaaa2c11cd01a171c469f18ce8ac10ca47b33273ac35af7cb85f23","observation_id":"9cfbe75d-afea-4e0f-a3ed-30cadf17f3f5","resolution":{"observed_at":"2026-05-16T17:53:11.732031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.16783/citation-record","integrity":"/paper/2411.16783/integrity","json":"/paper/2411.16783/citation-record.json","paper":"/paper/2411.16783"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.411668Z","title":"A-star: Test-time attention segregation and retention for text-to-image synthesis","venue":null,"work_id":"8fcff1cd-acea-4b09-9034-6345b8bd8d6e","year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.551943Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:a3a84432ce5dac4ac57616ccd8c7baaf69f19bca1148b38220e9a09264ff5e52","observation_id":"96e501ac-5673-48cd-87cd-fe676316fad3","resolution":{"observed_at":"2026-08-12T13:32:28.416583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T13:32:27.557350Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.557350Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:222ba7df966a4c6fc4bec2911a69271db8854304dcf8955ae64d7ceb13b00a96","observation_id":"413e500a-814b-4a2e-aafd-e92395e5aa1b","resolution":{"observed_at":"2026-08-12T13:32:27.557350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.395113Z","title":"Attend-and-excite: Attention-based se- mantic guidance for text-to-image diffusion models","venue":null,"work_id":"71394672-2cbc-4e53-aa55-ee5195825cbb","year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.562744Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:03e45eb39af1b6ead0258bca80a835b3326511459ee684e1c909fb9895463951","observation_id":"8c097ed7-8ea6-480f-966d-c5d53d430ce6","resolution":{"observed_at":"2026-08-12T13:32:28.400758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04312","last_updated":"2024-10-31T17:47:54Z","snapshot_observed_at":"2026-08-12T23:48:30.417654Z","submitted_at":"2024-06-06T17:56:40Z","title":"ReNO: Enhancing One-step Text-to-Image Models through Reward-based Noise Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04312","snapshot_observed_at":"2026-08-12T13:32:27.567713Z","title":"Reno: Enhancing one-step text-to-image models through reward-based noise optimiza- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.567713Z"},"links":{"cited_paper":"/paper/2406.04312","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:ca682f0c1c4cc867d754c79a7db0c32d60dcbbc5287863833ab2bd4bb90b178e","observation_id":"04d4e1a1-0ef6-42aa-a69e-e4b327b29f6d","resolution":{"observed_at":"2026-08-12T13:32:27.567713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.379083Z","title":"Prompt optimizer of text-to-image diffusion models for abstract con- cept understanding","venue":null,"work_id":"600a5e1c-6ccf-46fb-ac39-72df9b0019b4","year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.572743Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:3f10ee586b4fc793fd7edaf7931183b2499b36efed73a7b8198db1d0765874be","observation_id":"cb9ecfe4-1062-487d-b9ae-83ee91e3a48b","resolution":{"observed_at":"2026-08-12T13:32:28.383922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.363897Z","title":"Initno: Boosting text-to-image diffu- sion models via initial noise optimization","venue":null,"work_id":"eea489d9-b162-4b87-8b08-a3f47c6fb5a4","year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.577634Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:7aa5d2d8062a601bd7926b9f1b09a3267892950ae350f4b868b9edece85ceb50","observation_id":"341795db-9dbe-4744-b739-1367aa8fd306","resolution":{"observed_at":"2026-08-12T13:32:28.368810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.348715Z","title":"Optimizing prompts for text-to-image generation","venue":null,"work_id":"01438f41-63aa-49c9-bd59-4df71e4d61ac","year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.582679Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:83cdb49c2ce95b59d8bc1fa07c640520e67baa0560dff49dde624d02c5b28079","observation_id":"04faa725-f0cb-48d5-ae59-b0817e296a02","resolution":{"observed_at":"2026-08-12T13:32:28.353515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-12T13:32:27.587153Z","title":"Prompt-to-prompt im- age editing with cross attention control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.587153Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:67afbe0815cc0ad5d7256e7e4c6d9c8b78663796957d6d9a32f7fcb8be085cb6","observation_id":"08471b09-404d-4341-9f7c-1fe50b1671b3","resolution":{"observed_at":"2026-08-12T13:32:27.587153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-12T19:28:23.372660Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-12T13:32:27.592584Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.592584Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:e5649845f77e362e1fe74cfe4069e60e503da6f9e24dbd493c864719bdac5f1c","observation_id":"d8fdf4e3-7848-4812-9263-f9fc42a3f354","resolution":{"observed_at":"2026-08-12T13:32:27.592584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.333038Z","title":"Introvae: Introspective variational autoencoders for photo- 13 graphic image synthesis","venue":null,"work_id":"3b81e914-1026-4779-bc55-3e9517c0ddb6","year":2018},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.597379Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:e4e824ca1468847b46efa2b48cec0b868c0a5079482e5f1afb5c2a34e965c124","observation_id":"7bacc3f5-1a6b-4f26-a1b5-62fc43058093","resolution":{"observed_at":"2026-08-12T13:32:28.338147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.317749Z","title":"T2i-compbench: A comprehensive bench- mark for open-world compositional text-to-image genera- tion","venue":null,"work_id":"93b37550-6b54-4281-bf48-0c07b5196fa2","year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.601955Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:79929d8d373969e831361470a7a8ac9ce55108af9ddba0eb82810dd8a7b41d57","observation_id":"05901976-508a-450a-ad1e-4318f349889e","resolution":{"observed_at":"2026-08-12T13:32:28.322634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.606979Z","title":"Image-to-image translation with conditional adver- sarial networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.606979Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:542dcb68e3055f4c707065e065ad0a8dfc440061f33bdedb18574ea06d6dc1f0","observation_id":"8d8b03e7-34ea-433d-ba0d-501e39ed55e0","resolution":{"observed_at":"2026-08-12T13:32:27.606979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.611523Z","title":"A style-based generator architecture for generative adversarial networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.611523Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:d6be50228951519dc9d2a9317036dc5226fd8e118a094d0458d7baa56387da9c","observation_id":"f10c8735-0627-4141-ac5b-0c0b158e86c2","resolution":{"observed_at":"2026-08-12T13:32:27.611523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-12T13:32:27.617194Z","title":"Auto-encoding varia- tional bayes","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.617194Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:d2e44c46a7cc9a1f8ef15dc3c6b289d2b02dfc352a225a2bb0840c7a31ab663e","observation_id":"f8cd4c27-179e-4229-b0d8-59743be31701","resolution":{"observed_at":"2026-08-12T13:32:27.617194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.283045Z","title":"Segment any- thing","venue":null,"work_id":"dd32039d-8725-4923-8c63-521335266750","year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.622121Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:2bf5de4e21131d317b7df8983b663c3520887c6ee65c2588115fb0635872c733","observation_id":"d7b58385-7461-460e-b971-14b0c8c120e0","resolution":{"observed_at":"2026-08-12T13:32:28.287946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.626906Z","title":"The hungarian method for the assignment problem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.626906Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:1e3a7439cf0f74a2d2c93c434d32070b4ce6534a2025d0cf80badaa1a9a71d57","observation_id":"95556a0d-bd9e-41f3-842e-a30f735e40f3","resolution":{"observed_at":"2026-08-12T13:32:27.626906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.258406Z","title":"An algorithm for path connections and its applications","venue":null,"work_id":"4fc5992d-ba05-4f2a-9ba6-2900a5b817dc","year":1961},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.631680Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:4776143d0be16d514ab8c586aa71498e7ef43fef8c6eb4624de7b6fa753ba9d7","observation_id":"3c3733e8-e149-4054-b094-8c350deceb4a","resolution":{"observed_at":"2026-08-12T13:32:28.263141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.636429Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.636429Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:8914054c7e7e7060fad4653d0a0ea02764b0880395d705e44eaf66a71862f329","observation_id":"87b8c8ce-3619-49e2-891e-d6b1521f5a46","resolution":{"observed_at":"2026-08-12T13:32:27.636429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.233284Z","title":"Divide & bind your attention for improved generative seman- tic nursing","venue":null,"work_id":"1b4d48a5-3840-4e53-9829-b202c74a3f1f","year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.640877Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:ab53332e92d8413305e5b0948e2b6768823dbea5d4eaac718a42b6a24160d094","observation_id":"90951c43-02b3-412c-92b3-87b52b835bc0","resolution":{"observed_at":"2026-08-12T13:32:28.238490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01291","last_updated":"2024-06-18T07:09:55Z","snapshot_observed_at":"2026-08-13T00:39:54.992015Z","submitted_at":"2024-04-01T17:58:06Z","title":"Evaluating Text-to-Visual Generation with Image-to-Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01291","snapshot_observed_at":"2026-08-12T13:32:27.645607Z","title":"Evaluating text-to-visual generation with image-to-text gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.645607Z"},"links":{"cited_paper":"/paper/2404.01291","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:6381abd4bd480b7ce79c9601a5b59084f4d91ba5cd481c19990a9c60354cfdbe","observation_id":"0a3747bd-88b3-4eb8-acc4-ded9e679249d","resolution":{"observed_at":"2026-08-12T13:32:27.645607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-07-06T15:00:58.804337Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-12T13:32:27.650460Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.650460Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:5ba918cff6b98bbf73c1dd90750951215b964faddc0758fb533a77f90bff9571","observation_id":"6afc077e-4c7f-491d-bf82-09f3d3cb0034","resolution":{"observed_at":"2026-08-12T13:32:27.650460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17804","last_updated":"2024-03-26T15:42:01Z","snapshot_observed_at":"2026-08-13T00:44:36.119295Z","submitted_at":"2024-03-26T15:42:01Z","title":"Improving Text-to-Image Consistency via Automatic Prompt Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17804","snapshot_observed_at":"2026-08-12T13:32:27.655230Z","title":"Improving text- to-image consistency via automatic prompt optimization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.655230Z"},"links":{"cited_paper":"/paper/2403.17804","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:c68481c386d265386b97f964ffbe3c6cd0f6e7090abe78a1994defd189e83f18","observation_id":"e56d2af0-44a5-4470-82f7-941c9b8dc170","resolution":{"observed_at":"2026-08-12T13:32:27.655230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.216351Z","title":"Conform: Contrast is all you need for high- fidelity text-to-image diffusion models","venue":null,"work_id":"0e306bbd-a082-426a-b75b-e31770aae44b","year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.660299Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:7a3421d831bcd183ed2cef5be28c38ae6fa904ac5d6701b9d88c82dac716e9f9","observation_id":"b1ca31c9-f44b-4e6f-81f2-163d17922a37","resolution":{"observed_at":"2026-08-12T13:32:28.221799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.200618Z","title":"Dynamic prompt optimizing for text- to-image generation","venue":null,"work_id":"547080eb-ab2e-4d3c-b767-7defba69e188","year":2024},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.665754Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:d54f71f361d9c4b524b2b8079fdb75ab0fe6aa2ab432de0a618c4e4cec2b55ae","observation_id":"0495034c-1711-453b-816e-fd01c469d14e","resolution":{"observed_at":"2026-08-12T13:32:28.205564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.671141Z","title":"Semantic image synthesis with spatially-adaptive nor- malization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.671141Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:ca9ddfff4cf6c09e8a25ddfaa63f6884df1dac91f5d2ce57f8a28d5a1de7bd4f","observation_id":"2c942887-064f-4de3-92d0-747261c73eba","resolution":{"observed_at":"2026-08-12T13:32:27.671141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.675939Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.675939Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:2324aebe5eb29f27053e7bf3b7d40b7cf2e68baa5e185818dfc9169ee80973ef","observation_id":"41050cce-6aa5-404f-bd28-0d65dd79bb2b","resolution":{"observed_at":"2026-08-12T13:32:27.675939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.680483Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.680483Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:febecbbacaa1b84d747a29a298715bbb1dbb8b67d42a5e20aa0f68ade7d08732","observation_id":"e1eeb46d-e268-40dd-9ec2-230acb95ea5f","resolution":{"observed_at":"2026-08-12T13:32:27.680483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-12T13:32:27.685181Z","title":"Hierarchical text-conditional image gener- ation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.685181Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:8be81ace6ee8c1b2157ade15f3df906cbf43488360ad0e65bc960293e0c6621d","observation_id":"dca80376-6c9f-4806-8876-e6a0b8b02a5f","resolution":{"observed_at":"2026-08-12T13:32:27.685181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.155378Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"c78fc2e9-7805-4256-b7ab-7c8eb279d320","year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.690322Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:94891f8a724b225d23e4e98c8e708613eed5d08e3ea4026e9ecef1eb35669e7c","observation_id":"09c0416e-f07a-4ae6-890f-9ee1a97838b2","resolution":{"observed_at":"2026-08-12T13:32:28.160441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.695884Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.695884Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:4586652e435b343dcec987d485127db174a109f10f51e846d8ae03126f677875","observation_id":"3547c817-9747-432c-93be-c7a190021edf","resolution":{"observed_at":"2026-08-12T13:32:27.695884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1404.2000","last_updated":"2014-04-08T03:42:36Z","snapshot_observed_at":"2026-07-06T03:40:36.456030Z","submitted_at":"2014-04-08T03:42:36Z","title":"Notes on Kullback-Leibler Divergence and Likelihood","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1404.2000","snapshot_observed_at":"2026-08-12T13:32:27.700559Z","title":"Notes on kullback-leibler divergence and likelihood","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.700559Z"},"links":{"cited_paper":"/paper/1404.2000","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:bd34b35db035f4fa05178ee9ce712d5a55305bbae76b9247d111ca2fd2b1891f","observation_id":"60607be3-a856-47bc-a640-61d1c1467c37","resolution":{"observed_at":"2026-08-12T13:32:27.700559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.129787Z","title":"Df-gan: A simple and effec- tive baseline for text-to-image synthesis","venue":null,"work_id":"a69dd2d0-e1da-403c-ba61-7ecad544b504","year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.706364Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:d9f11170c9bab7504336643039e61cb750a01b3ed6ea6b4fbf79bbb4b2d874c1","observation_id":"6a9f499a-57d8-4238-8f1d-ddf8aa91fc79","resolution":{"observed_at":"2026-08-12T13:32:28.134772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.710922Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation","venue":null,"work_id":null,"year":1921},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.710922Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:a9ac0a13a83fc70bd57152d584b7e71f7cc496e298d227a6dec131280ffe64db","observation_id":"1bbea671-77da-40fb-8520-e235ec459d25","resolution":{"observed_at":"2026-08-12T13:32:27.710922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.715512Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.715512Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:5381829bb0fe634a38214a41d1b72bd51e0eda87d92faaa5867d72efcb0ff893","observation_id":"466b09ce-2dd9-4289-b572-f89424c65a45","resolution":{"observed_at":"2026-08-12T13:32:27.715512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.719987Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.719987Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:4d1bb635dfbd29986d4a2ff7d3a43d755f84e90b1a4bacfcbe8e159a1f1e99b7","observation_id":"309ee951-7ca2-4a99-bc1e-e442e9767e66","resolution":{"observed_at":"2026-08-12T13:32:27.719987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15462","last_updated":"2022-11-21T07:07:19Z","snapshot_observed_at":"2026-08-13T13:38:35.026010Z","submitted_at":"2022-11-21T07:07:19Z","title":"Investigating Prompt Engineering in Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15462","snapshot_observed_at":"2026-08-12T13:32:27.724590Z","title":"Investigating prompt engineering in diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.724590Z"},"links":{"cited_paper":"/paper/2211.15462","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:a35642393b6fbc52af16665d77ae9087eab77b88915a7e13a649f4b69cbae82b","observation_id":"706d41fe-8f25-4a42-9736-5b0e03171bec","resolution":{"observed_at":"2026-08-12T13:32:27.724590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.083873Z","title":"Attngan: Fine- grained text to image generation with attentional generative adversarial networks","venue":null,"work_id":"97a657e0-cc16-4d90-935e-b5d7d758a83d","year":2018},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.729480Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:6f816d3656ba555031432523fa0f41be5945300fe2f08950bd6fb4c33c6083c1","observation_id":"befc50ef-967f-4fb9-ad85-8561cf4405b3","resolution":{"observed_at":"2026-08-12T13:32:28.089485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.02423","last_updated":"2021-11-28T01:54:15Z","snapshot_observed_at":"2026-08-02T08:05:43.923760Z","submitted_at":"2021-07-06T06:43:31Z","title":"Improving Text-to-Image Synthesis Using Contrastive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.02423","snapshot_observed_at":"2026-08-12T13:32:27.734170Z","title":"Improving text-to-image synthesis us- ing contrastive learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.734170Z"},"links":{"cited_paper":"/paper/2107.02423","citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:926b3ab2447783155c9f7cd60fdad015c863ad69e4377348dab39aad994be14e","observation_id":"46ae488f-0a57-47ca-8eb5-b7fe3fdc3c5a","resolution":{"observed_at":"2026-08-12T13:32:27.734170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.067439Z","title":"Image binarization using otsu threshold- ing algorithm","venue":null,"work_id":"c217804e-c127-4e5b-87ad-646c4045a35f","year":null},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.739233Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:af5df12830fd94d32829f91b3efba97202befa14df271842bebe4415a7ec35dc","observation_id":"b098a5e9-b4fb-4064-9f82-e73b1b734ef8","resolution":{"observed_at":"2026-08-12T13:32:28.072301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.052204Z","title":"Cross-modal contrastive learning for text-to- image generation","venue":null,"work_id":"170b59fe-79cd-48d9-88bd-bb09c8bbcb9f","year":2021},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.743898Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:414c2af09b0d5cbae2739d892a26c054a4657e05162c0091bcd885a12783cd99","observation_id":"0d4574c4-3fe1-4873-a53b-411445c290de","resolution":{"observed_at":"2026-08-12T13:32:28.057097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.035759Z","title":"Unpaired image-to-image translation using cycle- consistent adversarial networks","venue":null,"work_id":"16290a32-0674-44b3-b7e9-30e1358bcaa5","year":2017},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.748162Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:48bc6f4b8ba43cc2d0dd54430c98fe3a060ae3d06a8e97d7cd4c9025d837ed32","observation_id":"f57a72f5-601c-4b8c-8537-6212e72a39a0","resolution":{"observed_at":"2026-08-12T13:32:28.040756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:28.019028Z","title":"To- ward multimodal image-to-image translation","venue":null,"work_id":"394cf1d7-ec1b-4cd8-91f9-773cf90a4fe4","year":2017},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.752974Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:39940464337c5bccb08a5534d4afa3dee3c65970d1839ab5378c1603419e060b","observation_id":"cd5c1002-e427-4a08-badf-ff61ec8f9c5f","resolution":{"observed_at":"2026-08-12T13:32:28.024321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T13:32:27.999245Z","title":"Dm-gan: Dynamic memory generative adversarial networks for text- to-image synthesis","venue":null,"work_id":"ab10ea7b-a624-40ee-8460-8da0ac602c88","year":2019},"citing_paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T13:32:27.757791Z"},"links":{"citing_paper":"/paper/2411.16783"},"observation_digest":"sha256:2b8ff080bbdd5c6ee04df17a95bb9e4b7feb9f9098d245a734aebe594436d782","observation_id":"ba6d2e5f-82d3-4a29-8020-136c9c6e0b1b","resolution":{"observed_at":"2026-08-12T13:32:28.006820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.16783","last_updated":"2024-11-25T08:20:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T21:57:21.590930Z","submitted_at":"2024-11-25T08:20:14Z","title":"CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 1 inbound Pith citation observation for arXiv:2411.16783."}