{"as_of":"2026-08-08T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f64d5bf3d654538664964ebcfb8fa07c12f81f5aab52abaaf9c3ad34a7ba8e95","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:10:57.109432Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.11533/citation-record","integrity":"/paper/2507.11533/integrity","json":"/paper/2507.11533/citation-record.json","paper":"/paper/2507.11533"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.394275Z","title":"Retinaface: Single-shot multi-level face localisation in the wild","venue":null,"work_id":"0b07abda-2c92-473b-9a70-c1c656ed9241","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.810512Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:19db0a3563d6ea75d73e3f5ca4a8710fb8606559c6749112516a19a99d4bd365","observation_id":"265b6ac2-a354-4164-b08a-bd6f92252d8b","resolution":{"observed_at":"2026-08-06T17:11:02.473423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.234374Z","title":"Taming transformers for high-resolution image synthesis","venue":null,"work_id":"a29fcc21-7f68-44be-930b-4395b41abf03","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.916151Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:cb2a94a1ed9cee694f99369f8d933753033cc17b0bb8733c9e98544c06ecc45d","observation_id":"d4d4d99e-3e07-48e2-91ec-0dca81fc1b74","resolution":{"observed_at":"2026-08-06T17:11:02.309918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:02.067479Z","title":"Scaling rec- tified flow transformers for high-resolution image synthesis","venue":null,"work_id":"18c62af2-2b0a-4923-b33d-1dd2512b75ac","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:53.995128Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:88b76b90ebc4a0c219dd96c1a0bef3e0b17c614e9aec7bf738776284b54b101b","observation_id":"95b34fec-ef58-41b3-b912-02801e2f3f77","resolution":{"observed_at":"2026-08-06T17:11:02.158346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.872989Z","title":"An image is worth one word: Personalizing text- to-image generation using textual inversion","venue":null,"work_id":"fba0b52a-7774-4eb3-8d6f-ed52a385b0fc","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.073083Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:74e1c8b11dd2ce841ceb36442bba6a0edd4b67792d3f6db5f731a686d672a3fe","observation_id":"3ea06750-5236-4c99-8371-0c9a0932f962","resolution":{"observed_at":"2026-08-06T17:11:01.963883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.672315Z","title":"Generative adversarial networks","venue":null,"work_id":"9ea20909-e127-45ed-95e1-c6e80cc17eea","year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.154372Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:a9bdab1d763c9f31518f21072ea3742642e25168ed28716a14596e27e48c8dbc","observation_id":"bb8e4ad0-8f64-419b-afeb-a9477f804cd9","resolution":{"observed_at":"2026-08-06T17:11:01.749680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.488185Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"54da40be-eb61-4ff6-8b2a-dbd896f87eed","year":2016},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.241237Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:3e70d0edf4609fea4c7ecfd69cc9df549fd0d4268b6e36d3d50bf6b82a95213f","observation_id":"8cbbe56a-6f21-4543-96fb-1d0665e97818","resolution":{"observed_at":"2026-08-06T17:11:01.561353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.280056Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"1b75d72f-388b-4f09-aa4c-8097460fcee7","year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.395124Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f95c599afaa58af3d2e97afe501cb72e61552e88528c1b60dffa4e7ce80378bf","observation_id":"ce765af6-ea03-4580-8862-977cdb6da211","resolution":{"observed_at":"2026-08-06T17:11:01.370400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:01.141166Z","title":"Kingma and Max Welling","venue":null,"work_id":"297b034c-1168-421c-aa11-3d91466efbc5","year":2014},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.481985Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:77c97e432577b8ff79fd123c3a29071ddb97b16e6f1b3eed5402db7bfc0e17c1","observation_id":"71efcc97-4f08-4a4d-9da4-ee9b37eeead8","resolution":{"observed_at":"2026-08-06T17:11:01.196214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.987974Z","title":"Segment anything","venue":null,"work_id":"062ecd89-c527-4352-b1ea-1679848b157d","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.566502Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:19fc3a3f015caf4215d12858cebe02f73bad012784b8f0dd46d700d5a9fdb50b","observation_id":"1c731071-646b-4bb5-84a4-d1228db1fab1","resolution":{"observed_at":"2026-08-06T17:11:01.049919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T17:10:54.669280Z","title":"Hunyuanvideo: A systematic framework for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.669280Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:782232ee6582818374042f97f2868f362714dc98f3d7cd71345e1e94dfc4cf47","observation_id":"541d7c7e-1122-40ff-8914-f5b37e8c522b","resolution":{"observed_at":"2026-08-06T17:10:54.669280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.847303Z","title":"Multi-concept customization of text-to-image diffusion","venue":null,"work_id":"c793037d-4592-4016-9dcc-734052a72493","year":1931},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.758410Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:cdbe0f5459b2114907e35a570df202460413d33fd98b8234dfb2d8faa4346f38","observation_id":"ed865555-2815-4eb1-b6c1-d21cd62a0432","resolution":{"observed_at":"2026-08-06T17:11:00.929691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.683278Z","title":null,"venue":null,"work_id":"4d8340bd-f696-4f06-a986-c59eb5669860","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.837662Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:d8979a9ef24ce5a7ca69f354d3838d22f3abe614aa5390686e6d4bc794b0eaf3","observation_id":"c15efee1-8daa-4f0e-bf07-e6b08cea0006","resolution":{"observed_at":"2026-08-06T17:11:00.786271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.546285Z","title":"Photomaker: Customizing realistic human photos via stacked id embedding","venue":null,"work_id":"67446e7e-d953-4ecf-80a3-3d00a807913d","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:54.948289Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:7054b58ca4c15c3447ac3a9343dc5a4650b96b64192d6a0d44ca6f424a7b48e4","observation_id":"3be95fc9-996a-4283-b29a-80df6a42d51c","resolution":{"observed_at":"2026-08-06T17:11:00.600287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08748","last_updated":"2024-05-14T16:33:25Z","snapshot_observed_at":"2026-07-06T18:14:16.386835Z","submitted_at":"2024-05-14T16:33:25Z","title":"Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08748","snapshot_observed_at":"2026-08-06T17:10:55.041081Z","title":"Hunyuan-dit: A powerful multi-resolution diffusion transformer with fine-grained chinese understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.041081Z"},"links":{"cited_paper":"/paper/2405.08748","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:8432825575d6ee2d8cb24fc7b337b2fdccd25e2d01edb3a948cb7fd1e37cf571","observation_id":"131fe098-44f5-4301-a768-3fb169eca97f","resolution":{"observed_at":"2026-08-06T17:10:55.041081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.387474Z","title":"AnyI2V: Animating any conditional image with motion control generation","venue":null,"work_id":"300bb697-b52d-486e-9c03-c64c280f59a9","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.141118Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:119a4e56556bc2c6d206bf5a4ef8386ddc207669d782da24da52292b7a174acc","observation_id":"a1b4a5d5-0a12-4e78-bede-cc2f615007cd","resolution":{"observed_at":"2026-08-06T17:11:00.474974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.230535Z","title":"One-prompt-one-story: Free-lunch consistent text- to-image generation using a single prompt","venue":null,"work_id":"b2aad65d-b500-4aad-a4ba-ed82b1e45cd9","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.224649Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:964db617bc601f66f9cdabbc6eee3f087038b9e8209b966181f1f370142ac672","observation_id":"5d62c815-a590-4268-b36d-76dec8eee726","resolution":{"observed_at":"2026-08-06T17:11:00.290184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:11:00.048088Z","title":"Flow straight and fast: Learning to generate and transfer data with rectified flow","venue":null,"work_id":"29696b24-4cdc-4425-94c0-06c61bc08d55","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.341211Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:adccdce2cb8fd4383ca1f45ef0f28995f1f6d585cdd7dc9fe9d6c9959861b407","observation_id":"f02eaabf-7c0d-48ac-826d-2c2e89251d87","resolution":{"observed_at":"2026-08-06T17:11:00.115795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.878436Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"cccb6090-b873-4d9f-9dac-02590a9621fe","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.427965Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f64568339cc92c018820b84b6d5ced5d58d9404b836d3bb0f4b94961fb6c3f97","observation_id":"73803863-a351-4d06-b6a6-07821a42d077","resolution":{"observed_at":"2026-08-06T17:10:59.946075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.651598Z","title":"SDXL: improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":"7322602f-e1d7-44a0-a09b-329a629bba5a","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.498786Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:d40da30a6f084bd3c148203f9de5477af4e22b0558d5a8bb7aa3739a21e47b78","observation_id":"64e77799-9e1d-47a5-b174-8f8cd678e63c","resolution":{"observed_at":"2026-08-06T17:10:59.740977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.457121Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"a94bffab-30ef-43f7-91f9-33f92be08d50","year":2021},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.595331Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:e89c1a191c68dbd5b8b2caee11c40a4108399ea8ebe1ec3f4c2ca23eb2f5083c","observation_id":"9443f140-ff8c-4dc7-8e6b-07c597e6831e","resolution":{"observed_at":"2026-08-06T17:10:59.553142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:55.670649Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.670649Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:b35c280dfd91de963042f259ddc06ae8d9dc4a451a4371a26477977337117960","observation_id":"bfd3321e-31d2-489d-aee3-81801d18f70a","resolution":{"observed_at":"2026-08-06T17:10:55.670649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.254465Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"259ceb04-95ab-403a-8dc6-9cebd381d87f","year":2022},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.809417Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:ab69131f914ec55d3d90a37c4eb228213c214286f531ea7663b19a0116e3f586","observation_id":"3224c327-776c-431d-9144-f722ea14dfb6","resolution":{"observed_at":"2026-08-06T17:10:59.383025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:55.893734Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.893734Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:3e173bc4e9788258327546517f763f34840c0e5ca217b3f6f3d944f9dda11bfa","observation_id":"2348b00f-bc24-4429-bb9c-5b4d2e01ac6d","resolution":{"observed_at":"2026-08-06T17:10:55.893734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:59.055083Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"33b266d0-bc37-4060-a9d1-ecb29fba6282","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:55.997508Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:fc33949e691a585e15bf670f62a62e646f90d7e4e8e4872e8804cd57604e11a3","observation_id":"7b2b5a6e-7c4b-4ee4-914d-3b405d67aaae","resolution":{"observed_at":"2026-08-06T17:10:59.159353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.897222Z","title":"Facenet: A unified embedding for face recognition and clustering","venue":null,"work_id":"635b8a25-5d18-415f-b9cd-f021ad8f001e","year":2015},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.063689Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:706ad4797cdc9b84bf05ba1c840671c8371dfbc673ab8c19eebfc533cc56cb90","observation_id":"a55721b5-0f75-4681-824f-5f1863c78822","resolution":{"observed_at":"2026-08-06T17:10:58.965028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14555","last_updated":"2024-06-20T17:58:52Z","snapshot_observed_at":"2026-07-06T18:34:24.078145Z","submitted_at":"2024-06-20T17:58:52Z","title":"A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14555","snapshot_observed_at":"2026-08-06T17:10:56.151197Z","title":"A survey of multimodal-guided image editing with text-to-image diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.151197Z"},"links":{"cited_paper":"/paper/2406.14555","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c72ad263cb0b0e8be091656f7dc7918bff3f65b43b8b2f491f16bfd56f5dab6f","observation_id":"8165f4f7-8e44-44bb-922b-a229563d7772","resolution":{"observed_at":"2026-08-06T17:10:56.151197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.686105Z","title":"Free-form motion control: A synthetic video generation dataset with controllable camera and object motions","venue":null,"work_id":"2381e8f1-d427-49ff-8186-af90f759b2d6","year":2025},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.250798Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:68686c210b492caa7e003c5cc31c2d4c945ed6b41a6b44c1f72e81157f1aaa29","observation_id":"210bbe84-1eeb-4c50-8f5c-081c9a7b6a0e","resolution":{"observed_at":"2026-08-06T17:10:58.790267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.451210Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"36db0cd6-e429-4573-8f84-4fd8c92afb7a","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.358144Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:b87a49a603dbcc6792e06a596765e1f85cd9580cd641ac48a602c0a8576f1af9","observation_id":"e596d6b7-1db6-4078-bcee-21d4a989525c","resolution":{"observed_at":"2026-08-06T17:10:58.560402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:56.451153Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.451153Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f790a611e73c9793d671123b3afbda61d13aadaf91f2f6ff5c21ebb5c999f5e5","observation_id":"d5af6f67-cdba-4160-b75d-2fa7cd195d18","resolution":{"observed_at":"2026-08-06T17:10:56.451153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.229457Z","title":"Emergent correspondence from image diffusion","venue":null,"work_id":"d48b2d5e-59c1-41e8-8e70-a1414366b28a","year":2023},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.551186Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:babcaffe7c1c548bc3c33ff762bf670a88a950cb08471fa053446736edd07802","observation_id":"07f1135e-8562-41ad-8500-b891fe871a40","resolution":{"observed_at":"2026-08-06T17:10:58.358214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:58.049251Z","title":"Training-free consistent text-to-image generation","venue":null,"work_id":"7f65c93d-275a-45cf-9784-2ad91505786a","year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.668290Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:253bfc07fb93ceb5d100c6338ac67856eb30672d9911be1cbb7b011ecf639ad3","observation_id":"21e60ba0-b5bd-4d7d-8029-237341a5baa6","resolution":{"observed_at":"2026-08-06T17:10:58.134020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.736148Z","title":"Attention is all you need","venue":null,"work_id":"0f0908ae-c838-41ff-afe1-d9fb63218849","year":2017},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.714147Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:cf38448a7102ea44f085e2463aa3abfb5024a7ab294a057ddb38ad94b213477f","observation_id":"108b17d9-3625-4633-b77b-31e2aa34c54c","resolution":{"observed_at":"2026-08-06T17:10:57.907876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.529899Z","title":"Q-align: teaching lmms for visual scoring via discrete text-defined levels","venue":null,"work_id":"07f54c99-a079-4f01-9fde-2b7a411de009","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.723071Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c9991683d85ee8d23b8ce9442de23a435d4e1b7c0c390976e1df4e56dbdcfb07","observation_id":"da84b0e4-84a7-46a0-bb4b-1ecdb073d806","resolution":{"observed_at":"2026-08-06T17:10:57.636294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-06T17:10:56.878136Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.878136Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:f5f59a75a1cfd51eed4f3734def9f3a06d7e380924a5fe73716d0003d5ae8f21","observation_id":"a7494b70-cfe7-4124-aa67-23d691a675ef","resolution":{"observed_at":"2026-08-06T17:10:56.878136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-06T17:10:56.991014Z","title":"Ip- adapter: Text compatible image prompt adapter for text-to- image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:56.991014Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:c1aa6251d4cbd4d466b1e75250a00293ae0f25956108edad630a3184a34298f6","observation_id":"030c493d-34de-4aed-a0f8-1315caaf9fc8","resolution":{"observed_at":"2026-08-06T17:10:56.991014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:10:57.299770Z","title":"Storydiffusion: Consistent self- attention for long-range image and video generation","venue":null,"work_id":"f24bfc93-aa64-4d33-8602-47665d86fa16","year":2024},"citing_paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:57.109432Z"},"links":{"citing_paper":"/paper/2507.11533"},"observation_digest":"sha256:4b7507cc0ff4d8fd0ca040952d3b7a6cc42ae8cddda239225a2bf9485f91e7e0","observation_id":"a8ea0be4-4528-4dd0-a484-1a53ddd6c1f1","resolution":{"observed_at":"2026-08-06T17:10:57.423235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11533","last_updated":"2025-07-15T17:58:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T17:04:19.137456Z","submitted_at":"2025-07-15T17:58:08Z","title":"CharaConsist: Fine-Grained Consistent Character Generation"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2507.11533."}